Views
No views yet
qwen31# 创建模型
2ollama create gsw-qwen3-0.6b-20251207-0016 -f Modelfile
3
4# 运行模型
5ollama run gsw-qwen3-0.6b-20251207-00161# 使用 GPU 加速 (ngl=99 表示所有层都放到 GPU)
2./llama-cli -m GSW-Qwen3-0.6B-20251207-0016-Q4_K_M.gguf -p "你的问题" -ngl 99
3
4# 交互模式
5./llama-cli -m GSW-Qwen3-0.6B-20251207-0016-Q4_K_M.gguf -i -ngl 99qwen3qwen3temperature: 0.7
top_p: 0.9
repetition_penalty: 1.05
max_tokens: 4096