Views
No views yet
\<think>\<context>\<answer>\<end>1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3tok = AutoTokenizer.from_pretrained("ziadrone/aries-reasoning-1.5b")
4model = AutoModelForCausalLM.from_pretrained(
5 "ziadrone/aries-reasoning-1.5b",
6 torch_dtype="bfloat16",
7 device_map="auto"
8)
9
10prompt = "<think> What is 123 + 456?"
11inputs = tok(prompt, return_tensors="pt").to("cuda")
12out = model.generate(**inputs, max_new_tokens=80)
13
14print(tok.decode(out[0]))
15