Views
No views yet
Qwen/Qwen3.5-9B.
It does not include merged base-model weights.adapter_model.safetensors: LoRA adapter weightsadapter_config.json: PEFT adapter configurationtokenizer.json, tokenizer_config.json, chat_template.jinja: tokenizer sidecars from the training run1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base_model = "Qwen/Qwen3.5-9B"
5adapter = "uam-rl/qwen35-9b-muon-lora-r16"
6
7tokenizer = AutoTokenizer.from_pretrained(adapter)
8model = AutoModelForCausalLM.from_pretrained(
9 base_model,
10 torch_dtype="auto",
11 device_map="auto",
12)
13model = PeftModel.from_pretrained(model, adapter)SFTTrainerQwen/Qwen3.5-9B