Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "vishal042002/Qwen2.5-3B-GRPO",
5 torch_dtype="auto",
6 device_map="cuda"
7)
8tokenizer = AutoTokenizer.from_pretrained("vishal042002/Qwen2.5-3B-GRPO")
9
10text = "Look at this series: 36, 34, 30, 28, 24, … What number should come next?"
11
12inputs = tokenizer(text, return_tensors="pt").to("cuda")
13
14outputs = model.generate(
15 **inputs,
16 max_new_tokens=128,
17 temperature=0.7,
18 top_p=0.9
19)
20
21response = tokenizer.batch_decode(outputs, skip_special_tokens=True)[0]
22print(response)