Views
No views yet
meta-models/Muse-Glimmer-30B, hechas para
servirlas en local con Ollama o llama.cpp. Los pesos y la licencia son del autor
original; aquí solo cambia el formato.Multimodal. La parte visual va en el ficherommproj-…, aparte de los pesos. Hay que cargarlo explícitamente (ver Uso) o el modelo queda ciego sin decirlo.
| Fichero | Tamaño | sha256 |
|---|---|---|
Muse-Glimmer-30B-Q4_K_M.gguf | 16.9 GB | 2b7e05404f4241ac… |
Muse-Glimmer-30B-Q8_0.gguf | 29.6 GB | ef5eb228b2b9914e… |
mmproj-Muse-Glimmer-30B-bf16.gguf | 3.8 GB | 3e732f1a45f0e494… |
Q4_K_M es el equilibrio de siempre; Q8_0 es prácticamente indistinguible del
original a cambio del doble de peso. Como referencia de VRAM: en 12 GB entra un
7-8B en Q8_0 o un 14B en Q4_K_M; de ahí para arriba, hay offload a CPU.LICENSE, USAGE_POLICY.md), como exige su redistribución.1# llama.cpp — los pesos y el proyector visual se cargan por separado
2llama-mtmd-cli -m Muse-Glimmer-30B-Q4_K_M.gguf \
3 --mmproj mmproj-Muse-Glimmer-30B-bf16.gguf --image foto.jpg -p "¿Qué ves?"
4
5# solo texto (Ollama)
6ollama run hf.co/popiAI/Muse-Glimmer-30B-GGUF:Q4_K_M| Modelo base | meta-models/Muse-Glimmer-30B |
| Commit del base | a4e59da52a7bc87ae7251dd5545c0dd437c44b68 |
| Intermedio | GGUF bf16 |
| llama.cpp | release b10353 |
cuantiza-y-publica del repo ml-lab. Se cuantiza un
commit concreto del repo base, no main: repetir esta tabla da los mismos GGUF.