Views
No views yet
Qwen/Qwen3-8Bb968826d9c46dd6066d109eabc6255188de9121810a5278100bec42de4760dce89e2496e0a04be9a5034cd262d76910bb6ec1bb8douyin-style-lab。1import torch
2from peft import PeftModel
3from transformers import AutoModelForCausalLM, AutoTokenizer
4
5base_id = "Qwen/Qwen3-8B"
6adapter_id = "jiaqianjing/qwen3-8b-douyin-chat-style-lora"
7
8tokenizer = AutoTokenizer.from_pretrained(base_id)
9base = AutoModelForCausalLM.from_pretrained(base_id, dtype=torch.bfloat16)
10model = PeftModel.from_pretrained(base, adapter_id).to("cuda").eval()
11
12messages = [
13 {
14 "role": "system",
15 "content": "自然、有节奏地回答;不要冒充真实人物,不确定时明确说明。",
16 },
17 {"role": "user", "content": "为什么宇宙里没有声音?"},
18]
19text = tokenizer.apply_chat_template(
20 messages, tokenize=False, add_generation_prompt=True, enable_thinking=False
21)
22inputs = tokenizer(text, return_tensors="pt").to("cuda")
23output = model.generate(**inputs, max_new_tokens=512, temperature=0.7, do_sample=True)
24print(tokenizer.decode(output[0, inputs.input_ids.shape[1]:], skip_special_tokens=True))license: other 发布:权重可用于研究和
上述辅助创作场景,但本发布不授予任何第三方原始内容的权利,也不表示真实创作者认可
或参与了本模型。使用者必须自行确认具体用途所需的权利和合规义务。