Views
No views yet
llama.cpp, NONET is available in multiple sizes and optimized for Android or Python-based environments.llama.cpp.| Model Name | Base Model | Size |
|---|---|---|
| ChatNONET-135m-tuned-q8_0.gguf | Smollm | 135M |
| ChatNONET-300m-tuned-q8_0.gguf | Smollm | 300M |
| ChatNONET-1B-tuned-q8_0.gguf | LLaMA 3.2 | 1B |
| ChatNONET-3B-tuned-q8_0.gguf | LLaMA 3.2 | 3B |
1# Clone llama.cpp and build it
2git clone https://github.com/ggerganov/llama.cpp
3cd llama.cpp
4make
5
6# Run the model
7./llama-cli -m ./ChatNONET-300m-tuned-q8_0.gguf -p "You are ChatNONET AI assistant." -cnvq8_0) via llama.cppllama.cpp1@misc{chatnonet2025,
2 title={ChatNONET: Offline Quantized Q&A Models},
3 author={Michael Cobol Agan},
4 year={2025},
5 note={\url{https://huggingface.co/McaTech/Nonet}},
6}