Views
No views yet
llama-3.11# 创建模型
2ollama create gsw-llama3.2-1b-20251207-0837 -f Modelfile
3
4# 运行模型
5ollama run gsw-llama3.2-1b-20251207-08371# 使用 GPU 加速 (ngl=99 表示所有层都放到 GPU)
2./llama-cli -m GSW-Llama3.2-1B-20251207-0837-Q4_K_M.gguf -p "你的问题" -ngl 99
3
4# 交互模式
5./llama-cli -m GSW-Llama3.2-1B-20251207-0837-Q4_K_M.gguf -i -ngl 99llama-3.1llama-3.1temperature: 0.7
top_p: 0.9
repetition_penalty: 1.05
max_tokens: 4096