Views
No views yet
realoperator42/trinity-nano-stheno-lora (attention-only LoRA, r=16, alpha=32) merged into
arcee-ai/Trinity-Nano-Preview and converted to GGUF.afmoe, so you need a llama.cpp build that includes AFMOE support.{% generation %} markers removed so --jinja parses cleanly.llama-cli -m trinity-nano-stheno-Q4_K_M.gguf --jinja -cnv| File | Size |
|---|---|
trinity-nano-stheno-Q4_K_M.gguf | 3.8 GB |
trinity-nano-stheno-Q8_0.gguf | 6.5 GB |