Views
No views yet
1# Download model
2huggingface-cli download gameversellc/hermes_3_tests_gv Hermes-3-Llama-3.2-3B_q4_0.gguf
3
4# Run inference
5./llama-cli -m Hermes-3-Llama-3.2-3B_q4_0.gguf -p "Your prompt here" -n 1001from llama_cpp import Llama
2
3llm = Llama(model_path="Hermes-3-Llama-3.2-3B_q4_0.gguf")
4output = llm("Your prompt here", max_tokens=100)
5print(output)