Views
No views yet
| Archivo | Propósito | Tamaño |
|---|---|---|
model_qwen35b_espanol_text_F16.gguf | Modelo de lenguaje Qwen3.5 MoE (texto) | ~69.4 GB |
mmproj_qwen35b_espanol_F16.gguf | Proyector visual Qwen3VL | ~899 MB |
1llama-server \
2 --model model_qwen35b_espanol_text_F16.gguf \
3 --mmproj mmproj_qwen35b_espanol_F16.gguf \
4 --ctx-size 131072 \
5 --port 80801llama-cli \
2 --model model_qwen35b_espanol_text_F16.gguf \
3 --mmproj mmproj_qwen35b_espanol_F16.gguf \
4 --image imagen.png \
5 --prompt "Describe esta imagen en español."vllm serve jpalmae/qwen35b-espanol-abl-merged-v3| Atributo | Valor |
|---|---|
| Arquitectura del modelo de texto | qwen35moe |
| Capas del modelo de texto | 41 (40 hidden + 1 MTP) |
| Proyector visual | qwen3vl_merger (Qwen3VL) |
| Tensores del modelo de texto | 733 |
| Tensores del proyector | 334 |
| Precisión | F16 |
| Contexto | 131072 tokens |
| Idioma | Español (fine-tune sobre base multimodal) |
| Licencia | MIT |
/nvme1/models/qwen35b-espanol-abl-merged-v3 en servidor propio.convert_hf_to_gguf.py de llama.cpp, con --mmproj para el proyector visual.model_qwen35b_espanol_F16_patched.gguf (text-only). Ahora incluye el par multimodal completo.1@misc{qwen35b-espanol-gguf-f16,
2 title={qwen35b-espanol-gguf-f16},
3 author={Jorge Palma Escobar},
4 year={2026},
5 howpublished={\url{https://huggingface.co/jpalmae/qwen35b-espanol-gguf-f16}}
6}