Views
No views yet
chosen and rejected completions85% rejection on unsafe or adversarial inputs
80% preference over SFT responses on standard Vietnamese prompts
1from transformers import AutoTokenizer, AutoModelForCausalLM
2
3# Load model
4tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen1.5-1.8B-Chat")
5model = AutoModelForCausalLM.from_pretrained("522H0134-NguyenNhatHuy/Qwen-1.5-1.8B-Chat-DPO")
6
7# Chat with the model
8prompt = "Tôi cần lời khuyên để giảm stress công việc."
9inputs = tokenizer(prompt, return_tensors="pt")
10outputs = model.generate(**inputs, max_new_tokens=200)
11print(tokenizer.decode(outputs[0], skip_special_tokens=True))