Views
No views yet
CEIA-UFG/Gemma-3-Gaia-PT-BR-4b-it, derivado de google/gemma-3-4b-pt.| Arquivo | Uso recomendado |
|---|---|
gaia-ptbr-4b-q4_k_m.gguf | Recomendado para uso geral com Ollama/Odisseus. Melhor equilíbrio entre tamanho, velocidade e qualidade. |
gaia-ptbr-4b-q5_k_m.gguf | Melhor qualidade que Q4, consumindo mais RAM/VRAM. |
gaia-ptbr-4b-f16.gguf | Versão F16, útil para referência, novas quantizações ou ambientes com mais memória. |
Modelfile | Exemplo pronto para criar o modelo no Ollama usando a quantização Q4_K_M. |
Modelfile incluído:1git clone https://huggingface.co/mrbitsdcf/Gemma-3-Gaia-PT-BR-4b-it-GGUF
2cd Gemma-3-Gaia-PT-BR-4b-it-GGUF
3ollama create gaia-ptbr -f Modelfile
4ollama run gaia-ptbrModelfile usa por padrão:FROM ./gaia-ptbr-4b-q4_k_m.ggufFROM para o arquivo desejado, por exemplo:FROM ./gaia-ptbr-4b-q5_k_m.ggufllama-server:llama-server -m gaia-ptbr-4b-q4_k_m.gguf -c 81921curl http://localhost:8080/v1/chat/completions -H "Content-Type: application/json" -d '{
2 "model": "gaia-ptbr",
3 "messages": [
4 {"role": "system", "content": "Você é um assistente em português brasileiro."},
5 {"role": "user", "content": "Explique o que é um modelo GGUF em uma frase."}
6 ]
7 }'gemma33.9Bpt)gemma131072Modelfile limita num_ctx a 8192 por padrão para uso local mais previsível. Ajuste conforme a memória disponível no servidor.