Views
No views yet
gemma-31# 创建模型
2ollama create gsw-gemma3-270m-20251206-1636 -f Modelfile
3
4# 运行模型
5ollama run gsw-gemma3-270m-20251206-16361# 使用 GPU 加速 (ngl=99 表示所有层都放到 GPU)
2./llama-cli -m GSW-Gemma3-270M-20251206-1636-Q4_K_M.gguf -p "你的问题" -ngl 99
3
4# 交互模式
5./llama-cli -m GSW-Gemma3-270M-20251206-1636-Q4_K_M.gguf -i -ngl 99gemma-3gemma-3temperature: 0.7
top_p: 0.9
repetition_penalty: 1.05
max_tokens: 4096