Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model = AutoModelForCausalLM.from_pretrained(
4 "bh1scw/qwen3-0.6b-notifai",
5 device_map="auto",
6 trust_remote_code=True
7)
8tokenizer = AutoTokenizer.from_pretrained("bh1scw/qwen3-0.6b-notifai")
9
10# 推理
11messages = [{"role": "user", "content": "App: Slack\nTitle: #critical\nBody: PROD DOWN"}]
12prompt = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
13inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
14outputs = model.generate(**inputs, max_new_tokens=50)
15print(tokenizer.decode(outputs[0]))