Views
No views yet
gemma-4-E2B-it-uncensored-agentic-ggufQ4_K_M) de gemma-4-E2B-it-uncensored-agentic, un modèle ajusté spécifiquement pour les tâches agentiques complexes, l'utilisation d'outils (tool-use) et le raisonnement par étapes (Chain-of-Thought). Ce modèle est basé sur TrevorJS/gemma-4-E2B-it-uncensored, fine-tuné à l'aide d'Unsloth sur Google Colab.<think>...</think>) avant la génération de code ou l'appel de fonctions, permettant une intégration propre dans des boucles d'agents autonomes (ex. OpenCode, E2B executor).q_proj, k_proj, v_proj, o_proj, gate_proj, up_proj, down_proj) avec un rang élevé $r = 32$ et un $\alpha = 64$ pour capturer la syntaxe complexe des appels de fonctions et du code.packing = False) : Choix essentiel lors du SFT pour préserver l'intégrité logique des limites de sessions d'agents et éviter d'interférer avec le comportement de tool-calling.max_seq_length) : 4096 tokens (optimisé pour stocker les longues traces d'exécution et les historiques de conversation d'agents).learning_rate = 2e-5) : Configuration mesurée pour préserver les poids uncensored du modèle d'origine tout en affinant ses capacités logiques.lambda/hermes-agent-reasoning-traces, sous-ensembles kimi et glm-5.1).armand0e/qwen3.7-max-pi-traces).enable_thinking: True activée pour forcer le comportement d'analyse pas-à-pas.model_gguf/gemma-4-E2B-it-uncensored-agentic-Q4_K_M.gguf contient déjà le gabarit d'invite (chat template) natif configuré avec le support des outils.Modelfile :1FROM ./model_gguf/gemma-4-E2B-it-uncensored-agentic-Q4_K_M.gguf
2
3# Paramètres optimaux d'inférence
4PARAMETER temperature 0.6
5PARAMETER top_p 0.95
6PARAMETER num_ctx 4096
7
8# Template de discussion natif avec mode de réflexion activé
9TEMPLATE """{{ if .System }}<|im_start|>system
10{{ .System }}<|im_end|>
11{{ end }}{{ if .Prompt }}<|im_start|>user
12{{ .Prompt }}<|im_end|>
13{{ end }}<|im_start|>assistant
14{{ .Response }}<|im_end|>"""1ollama create gemma4-agentic -f Modelfile
2ollama run gemma4-agenticllama-cli)1llama-cli \
2 -m model_gguf/gemma-4-E2B-it-uncensored-agentic-Q4_K_M.gguf \
3 -p "<|im_start|>user\nWrite a python script to run a binary search over a sorted list and explain its complexity.<|im_end|>\n<|im_start|>assistant\n<think>\n" \
4 -n 1024 \
5 --temp 0.6 --top-p 0.95 \
6 -c 4096| Paramètre | Valeur recommandée | Justification |
|---|---|---|
temperature | 0.6 | Laisse une flexibilité suffisante pour la génération de code sans halluciner. |
top_p | 0.95 | Concentre la probabilité sur les sorties les plus propres. |
max_new_tokens | 1024 / 2048 | Budget généreux nécessaire pour le <think> et le code de sortie. |
<think> : Les réponses s'ouvrent généralement par une balise <think> et se referment par </think> avant d'apporter la réponse ou d'appeler un outil. Assurez-vous que vos scripts de parsing d'agents en tiennent compte.