Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base = "Qwen/Qwen3-4B-Instruct-2507"
5adapter = "ZaneSFL/zh-ppt-voice-agent-model-lora-support-interrupt"
6
7tokenizer = AutoTokenizer.from_pretrained(adapter, trust_remote_code=True)
8model = AutoModelForCausalLM.from_pretrained(
9 base, torch_dtype="auto", device_map="auto", trust_remote_code=True
10)
11model = PeftModel.from_pretrained(model, adapter)messages + apply_chat_template 推理即可。