1from transformers import AutoTokenizer
2from unsloth import FastLanguageModel
3
4model, tokenizer = FastLanguageModel.from_pretrained(
5 model_name = "VinitT/Qwen2-0.5B-DPO",
6 dtype = None,
7 load_in_4bit = False,
8)
9
10messages = [{"role": "user", "content": "Hello,how can i develop a habit of drawing daily?"}]
11inputs = tokenizer.apply_chat_template(
12 messages,
13 tokenize=True,
14 add_generation_prompt=True,
15 return_dict=True,
16 return_tensors="pt"
17)
18inputs = {k: v.to(model.device) for k, v in inputs.items()}
19
20# Generate
21outputs = model.generate(
22 **inputs,
23 max_new_tokens=100,
24 temperature=0.7,
25 top_p=0.9,
26 do_sample=True
27)
28# Decode only the new response (not the prompt)
29prompt_len = inputs["input_ids"].shape[-1]
30response = tokenizer.decode(outputs[0][prompt_len:], skip_special_tokens=True)
31
32print(response.strip())