Views
No views yet
microsoft/FastContext-1.0-4B-SFT (no longer available on the Hub), supervised fine-tuned on ermiaazarkhalili/claude-reasoning-distillation (private) (config sft).ermiaazarkhalili/FastContext-4B-SFT_base-SFT-Claude-Opus-Reasoning-Unsloth. See that repository for the full-precision weights.| Base model | microsoft/FastContext-1.0-4B-SFT (no longer available on the Hub) |
| Training data | ermiaazarkhalili/claude-reasoning-distillation (private) (config sft) |
| Method | LoRA supervised fine-tuning via Unsloth + TRL |
| File | Size |
|---|---|
fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q2_k.gguf | 1.67 GB |
fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q3_k_m.gguf | 2.08 GB |
fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q4_k_m.gguf | 2.50 GB |
fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q5_k_m.gguf | 2.89 GB |
fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q6_k.gguf | 3.31 GB |
fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q8_0.gguf | 4.28 GB |
1huggingface-cli download ermiaazarkhalili/FastContext-4B-SFT_base-SFT-Claude-Opus-Reasoning-Unsloth-GGUF fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q4_k_m.gguf --local-dir .
2llama-cli -m fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q4_k_m.gguf -p "Explain gradient checkpointing in two sentences." -n 2561echo 'FROM ./fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth.q4_k_m.gguf' > Modelfile
2ollama create fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth-gguf -f Modelfile
3ollama run fastcontext-4b-sft_base-sft-claude-opus-reasoning-unsloth-gguf| Setting | Value |
|---|---|
| LoRA rank (r) | 16 |
| LoRA alpha | 16 |
| Learning rate | 0.0002 |
| Epochs | 1 |
| Effective batch size | 8 (2 x 4 grad accum) |
| Max sequence length | 2048 |
| Base precision | 4-bit (QLoRA) |
| Target modules | q_proj, k_proj, v_proj, o_proj, gate_proj, up_proj, down_proj |
| SLURM job | Steps | First loss | Final loss |
|---|---|---|---|
53225528 | 94,254 | 1.1628 | 0.8690 |
45169147 | 1,310 | 1.1558 | 0.8011 |
notebooks/sft_distillation_fastcontext-4b-sft_unsloth.ipynb, executed non-interactively with
papermill on a SLURM H100 partition (Unsloth + TRL, LoRA).scripts/generate_hub_model_card.py.