Views
No views yet

1from transformers import pipeline
2
3generator = pipeline("text-generation", model="theprint/GeneralChat-Llama3.2-3B-DPO", device="cuda")
4output = generator(
5 [{"role": "user", "content": "Your prompt here"}],
6 max_new_tokens=256,
7 return_full_text=False
8)[0]
9print(output["generated_text"])| Parameter | Value |
|---|---|
| Method | DPO |
| Base model | theprint/GeneralChat-Llama3.2-3B |
| Dataset | theprint/Tom-4.2k-alpaca |
| Beta | 0.125 |
| LoRA r / alpha | 16 / 32 |
| Learning rate | 1e-5 |
| Epochs | 2 |
| Run name | llama3.2-3b-datom-dpo-0310 |