Views
No views yet
*.Q4_K_M.gguf ou *q4_k_m*.gguf: quantizacao recomendada para uso local leve.*.Q8_0.gguf ou *q8_0*.gguf: qualidade maior, arquivo maior.*.F16.gguf ou *f16*.gguf: diagnostico/fidelidade, arquivo grande..gguf deste repositório e valide com o CLI do projeto:1dotnet run --project src/LlamaSharpModel.Cli -- \
2 --model models/gemma4-4b-gguf/model-q4_k_m.gguf \
3 --prompt "Explique o objetivo do projeto em uma frase."<bos> manualmente:1<start_of_turn>user
2...<end_of_turn>
3<start_of_turn>modelllamasharp-model:1cd training
2uv sync --extra train
3uv run llamasharp-model-prepare-data --config ../configs/train.gemma4-4b.yaml
4uv run llamasharp-model-train --config ../configs/train.gemma4-4b.yaml
5uv run llamasharp-model-export-gguf --config ../configs/train.gemma4-4b.yaml --quant q4_k_mgoogle/gemma-4-4b-it no seu ambiente antes de treinar.google/gemma-4-4b-it. O uso e redistribuicao devem respeitar os termos da licença Gemma e quaisquer restrições dos dados usados no fine-tuning.