Views
No views yet
epoch=0-step=4200.ckpt on top of Qwen/Qwen3-4B-Instruct-2507.1from peft import PeftModel
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4base_model_name = "Qwen/Qwen3-4B-Instruct-2507"
5adapter_name = "zechen-nlp/parallel-ttt-cot-qwen3-4b-v1"
6
7tokenizer = AutoTokenizer.from_pretrained(adapter_name)
8base_model = AutoModelForCausalLM.from_pretrained(
9 base_model_name,
10 torch_dtype="auto",
11 trust_remote_code=True,
12)
13model = PeftModel.from_pretrained(base_model, adapter_name)adapter_config.jsonadapter_model.safetensorstokenizer_config.json with the chat templategeneration_config.json