Views
No views yet
nb_core_news_lg (Norwegian dependency parser)).nb_core_news_lg oracle. Held-out eval: Stanza nb.
ScaLA NB AUROC: 0.593 → 0.590. Summarisation PS: 44.5% → 100%.| Metric | Base | + Δ-DPO |
|---|---|---|
| Parse success | 84.5% | 100.0% |
| Parse score | 0.391 | 0.666 |
| PPL-Wiki | 16.8 | 29.6 |
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base = AutoModelForCausalLM.from_pretrained("google/gemma-4-E4B", torch_dtype="auto")
5model = PeftModel.from_pretrained(base, "emilcw/gemma4-e4b-nb-saga-kl-sft-delta-dpo")
6
7tokenizer = AutoTokenizer.from_pretrained("google/gemma-4-E4B")
8
9prompt = "Norsk er"
10inputs = tokenizer(prompt, return_tensors="pt")
11output = model.generate(**inputs, max_new_tokens=60, temperature=0.8, do_sample=True)
12print(tokenizer.decode(output[0], skip_special_tokens=True))nb_core_news_lg (Norwegian dependency parser)1@article{fakhar2025saga,
2 title={SAGA: Syntax-Aware Grammar Alignment for Low-Resource Nordic Languages},
3 author={Fakhar, Hoda and others},
4 year={2025},
5 note={Under review}
6}