Views
No views yet
Qwen3.5-4B, explicitly optimized for complex mathematical reasoning and Chain-of-Thought (CoT) problem solving. It was fine-tuned using the Nemotron-Math-v3 dataset with Parameter-Efficient Fine-Tuning (PEFT/LoRA).Qwen/Qwen3.5-4Bnvidia/Nemotron-SFT-Math-v3lora_alpha scaling is specifically tuned to prevent catastrophic forgetting, ensuring the model retains conversational abilities while significantly enhancing mathematical logic.F16) and GGUF formats (Q8_0)1{
2 "temperature": 1.0,
3 "top_p": 0.95,
4 "repetition_penalty": 1.1
5}repetition_penalty of 1.1 is crucial to prevent the base model from occasionally falling into infinite generation loops on extremely long context windows.