Views
No views yet
SmolLM3-3B-4bit.Q4_K_M.gguf — 1.92 GBllama serve -hf Spakie/Smolpus-3B-GGUF-Q4:Q4_K_Mollama run hf.co/Spakie/Smolpus-3B-GGUF-Q4:Q4_K_M1from llama_cpp import Llama
2
3llm = Llama.from_pretrained(
4 repo_id="Spakie/Smolpus-3B-GGUF-Q4",
5 filename="SmolLM3-3B-4bit.Q4_K_M.gguf",
6)
7llm.create_chat_completion(
8 messages=[{"role": "user", "content": "Explain what a transformer is."}]
9)