Views
No views yet
| Config | Value |
|---|---|
| Bits | 4 |
| Group Size | 64 |
| Quantization Mode | Affine |
| Dtype | bfloat16 |
pip install mlx-lm transformersmlx-lm1from mlx_lm import load
2
3model, tokenizer = load("Zeknes/Qwen3-VL-Embedding-8B-MLX-4bit")1@article{qwen3vlembedding,
2 title={Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking},
3 author={Li, Mingxin and Zhang, Yanzhao and Long, Dingkun and Chen Keqin and Song, Sibo and Bai, Shuai and Yang, Zhibo and Xie, Pengjun and Yang, An and Liu, Dayiheng and Zhou, Jingren and Lin, Junyang},
4 journal={arXiv preprint arXiv:2601.04720},
5 year={2026}
6}