Views
No views yet
| Base | Qwen/Qwen3.6-35B-A3B (MoE, ~3B active) |
| LoRA targets | attention only (no MLP) |
| Eval loss | 3.01 |
| Known issues | inconsistent <think>; does math despite character canon; weak jailbreak resistance |
pip install "transformers>=5.5" peft torch accelerate1import json
2import re
3import torch
4import transformers
5from peft import PeftModel
6from transformers import AutoTokenizer
7
8BASE = "Qwen/Qwen3.6-35B-A3B"
9ADAPTER = "s-g-labs/linlu-lora-v0.1-qwen3.6-35b-a3b"
10
11from transformers import AutoConfig
12arch = AutoConfig.from_pretrained(BASE, trust_remote_code=True).architectures[0]
13cls = getattr(transformers, arch) # Qwen3_5MoeForConditionalGeneration
14tok = AutoTokenizer.from_pretrained(BASE, trust_remote_code=True)
15model = cls.from_pretrained(BASE, dtype=torch.bfloat16, device_map="auto",
16 trust_remote_code=True)
17model = PeftModel.from_pretrained(model, ADAPTER)
18model.eval()
19
20n = sum(1 for k, m in model.named_modules()
21 if k.endswith("lora_B.default") and m.weight.abs().max() > 0)
22assert n > 0, "adapter not loaded"
23
24system = """你将扮演「林路」,正在用中文和「对方」聊天。像真人发微信,可一次发多条短消息。
25【人物能力与爱好】文学、网球、羽毛球;不擅长数学、做饭。
26【当前亲密度】30
27"""
28
29def chatml(system, history):
30 s = f"<|im_start|>system\n{system}<|im_end|>\n"
31 for role, content in history:
32 s += f"<|im_start|>{role}\n{content}<|im_end|>\n"
33 return s + "<|im_start|>assistant\n"
34
35ids = tok(chatml(system, [("user", "周末一般干嘛?")]), return_tensors="pt").to(model.device)
36eos = [tok.eos_token_id, tok.convert_tokens_to_ids("<|im_end|>")]
37with torch.no_grad():
38 out = model.generate(**ids, max_new_tokens=300, do_sample=True,
39 temperature=0.8, top_p=0.95, repetition_penalty=1.05,
40 eos_token_id=eos, pad_token_id=tok.pad_token_id or eos[0])
41raw = tok.decode(out[0][ids.input_ids.shape[1]:], skip_special_tokens=True)
42bubbles = [ln for ln in raw.split("\n") if ln.strip()]
43print(bubbles)AutoModelForCausalLM — use Qwen3_5MoeForConditionalGeneration.(系统提示:新的一天开始了,请像往常一样主动给对方发消息,开启今天的聊天。)1llamafactory-cli chat \
2 --model_name_or_path ./Qwen3.6-35B-A3B \
3 --adapter_name_or_path s-g-labs/linlu-lora-v0.1-qwen3.6-35b-a3b \
4 --template qwen --trust_remote_code