Views
No views yet
Note: Llama 3.1 8B is a gated model — request access at HuggingFace before downloading.
| Metric | Base | + Δ-DPO (no SFT) |
|---|---|---|
| Stanza PS ↑ | 80.5% | 94.0% |
| Stanza score ↑ | 0.388 | 0.592 |
| PPL-Wiki ↓ | 13.2 | 13.2 |
| Summarisation PS ↑ | 50.0% | 92.5% |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base = AutoModelForCausalLM.from_pretrained("meta-llama/Llama-3.1-8B", torch_dtype="auto")
5model = PeftModel.from_pretrained(base, "Hodfa71/llama-3.1-8b-da-saga-delta-dpo")
6tokenizer = AutoTokenizer.from_pretrained("meta-llama/Llama-3.1-8B")
7
8prompt = "Dansk er"
9inputs = tokenizer(prompt, return_tensors="pt")
10output = model.generate(**inputs, max_new_tokens=60, temperature=0.8, do_sample=True)
11print(tokenizer.decode(output[0], skip_special_tokens=True))da_core_news_lg (Danish dependency parser)1@article{fakhar2025saga,
2 title={SAGA: Syntax-Aware Grammar Alignment for Low-Resource Nordic Languages},
3 author={Fakhar, Hoda and others},
4 year={2025},
5 note={Under review}
6}