Views
No views yet
Qwen/Qwen3-0.6B1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_id = "zhb12/Qwen3-0.6B-fulldata-v4-safety-epoch3"
4tokenizer = AutoTokenizer.from_pretrained(model_id)
5model = AutoModelForCausalLM.from_pretrained(
6 model_id,
7 device_map="auto",
8 dtype="auto",
9)
10
11messages = [{"role": "user", "content": "Hello!"}]
12inputs = tokenizer.apply_chat_template(
13 messages,
14 add_generation_prompt=True,
15 tokenize=True,
16 return_dict=True,
17 return_tensors="pt",
18).to(model.device)
19
20outputs = model.generate(**inputs, max_new_tokens=128)
21response = tokenizer.decode(
22 outputs[0][inputs["input_ids"].shape[-1]:],
23 skip_special_tokens=True,
24)
25print(response)transformers>=4.51.0).