Views
No views yet
facebook/nllb-200-1.3B with the GSPO LoRA merged in — load directly, no PEFT needed.1import torch
2from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
3tok = AutoTokenizer.from_pretrained("Thermostatic/rosettia-quy-gspo-nllb13b-merged", src_lang="spa_Latn", tgt_lang="quy_Latn")
4m = AutoModelForSeq2SeqLM.from_pretrained("Thermostatic/rosettia-quy-gspo-nllb13b-merged", torch_dtype=torch.bfloat16).cuda().eval()
5bos = tok.convert_tokens_to_ids("quy_Latn")
6enc = tok("No se por que sucedio eso.", return_tensors="pt").to("cuda")
7print(tok.batch_decode(m.generate(**enc, forced_bos_token_id=bos, num_beams=5, max_new_tokens=128), skip_special_tokens=True)[0])