Views
No views yet
| Klasör | İçerik |
|---|---|
final/ | Model ağırlıkları (LoRA adapter) |
checkpoints/epoch_N/ | Epoch checkpointları |
eval/ | BLEU / ROUGE / BERTScore sonuçları |
logs/ | Eğitim log |
| Karar | Kaynak |
|---|---|
| Output < 20 kelime filtrele | Long Is More (arXiv:2402.04833) |
| Multi-turn context | SoulChat (arXiv:2311.00273) |
| lora_dropout=0.1 | LoRA Dropout (arXiv:2404.09610) |
| weight_decay=0.01 | AdaLoRA (arXiv:2303.10512) |
| Emotion etiketi + sistem promptu | EmPO (arXiv:2406.19071) |
| Training Loss | 1.1425 |
| Süre | 130.5 dk |
| Train samples | 3084 |
1from peft import PeftModel
2from transformers import AutoModelForCausalLM, AutoTokenizer
3import torch
4
5base = AutoModelForCausalLM.from_pretrained("mistralai/Mistral-7B-Instruct-v0.2", torch_dtype=torch.float16, device_map="auto")
6model = PeftModel.from_pretrained(base, "nvlz/mistral-ed-only", subfolder="final")
7tokenizer = AutoTokenizer.from_pretrained("nvlz/mistral-ed-only", subfolder="final")