Views
No views yet
| Metric | Base 356M | SDPO KL-SFT Antihack |
|---|---|---|
| Stanza parse success | 0.725 | 0.810 |
| Stanza mean quality | 0.471 | 0.525 |
| Stanza parse score | 0.341 | 0.426 |
| Wiki PPL | 22.85 | 23.81 |
| ScaLA AUROC | 0.680 | 0.684 |
1from peft import PeftModel
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4base = AutoModelForCausalLM.from_pretrained("Hodfa71/saga-is-356m-kl-sft")
5model = PeftModel.from_pretrained(base, "acbueff/gpt-sw3-356m-is-saga-kl-sft-sdpo")
6tokenizer = AutoTokenizer.from_pretrained("acbueff/gpt-sw3-356m-is-saga-kl-sft-sdpo")is.
Inherits the base model license (AI Sweden LLM License).