Views
No views yet
| Parameter | Nilai |
|---|---|
| Base Model | deepseek-ai/DeepSeek-R1-Distill-Qwen-7B |
| LoRA Rank | 32 |
| LoRA Dropout | 0.1 |
| Compression Rate | 4 |
| Epochs | 20 |
| Batch Size | 1 |
| Gradient Accumulation | 4 |
| Learning Rate | 0.0001 |
| Max Seq Len | 1024 |
| CE Weight | 1.0 |
| KL Weight | 0.5 |
| FP16 | True |
1from transformers import AutoTokenizer, AutoModelForCausalLM
2from peft import PeftModel
3
4base_model = AutoModelForCausalLM.from_pretrained("deepseek-ai/DeepSeek-R1-Distill-Qwen-7B")
5tokenizer = AutoTokenizer.from_pretrained("Gabriel2502/DeepSeek-R1-Distill-Qwen-7B-latent-sft-stage2_v2")
6model = PeftModel.from_pretrained(base_model, "Gabriel2502/DeepSeek-R1-Distill-Qwen-7B-latent-sft-stage2_v2")
7model = model.merge_and_unload() # Opsional: merge LoRA ke base model