Views
No views yet
1# 创建模型
2ollama create educhat-1.8b-qwen1.5-q4_k_m-20251207 -f Modelfile
3
4# 运行模型
5ollama run educhat-1.8b-qwen1.5-q4_k_m-202512071# 使用 GPU 加速
2./llama-cli -m EduChat-1.8B-Qwen1.5-Q4_K_M-20251207-Q4_K_M.gguf -p "你的问题" -ngl 99
3
4# 交互模式
5./llama-cli -m EduChat-1.8B-Qwen1.5-Q4_K_M-20251207-Q4_K_M.gguf -i -ngl 99temperature: 0.7
top_p: 0.9
repetition_penalty: 1.05
max_tokens: 4096