Views
No views yet
mistralai/Mistral-7B-Instruct-v0.2| Param | Value |
|---|---|
| Epochs | 3 |
| Effective batch size | 16 |
| Learning rate | 2e-4 |
| LoRA r | 16 |
| LoRA alpha | 32 |
| Max seq length | 512 |
| Metric | Value |
|---|---|
| Train loss | 4.33 → 1.83 |
| Eval loss (best) | 1.87 |
| Perplexity | 6.42 |
1from peft import PeftModel
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4base = AutoModelForCausalLM.from_pretrained("mistralai/Mistral-7B-Instruct-v0.2")
5model = PeftModel.from_pretrained(base, "indrang21/mistral-7b-fi-en-qlora-v1")
6tokenizer = AutoTokenizer.from_pretrained("indrang21/mistral-7b-fi-en-qlora-v1")
7
8inputs = tokenizer("[FI] Tervetuloa. [EN]", return_tensors="pt")
9outputs = model.generate(**inputs, max_new_tokens=50)
10print(tokenizer.decode(outputs[0]))