Views
No views yet
Qwen/Qwen3.8-27B + 顾城 SFT LoRA adapter 的 KTO 后训练 adapter。1from transformers import AutoModelForCausalLM, AutoProcessor, BitsAndBytesConfig
2from peft import PeftModel
3import torch
4
5base = "Qwen/Qwen3.8-27B"
6adapter = "shikunpunk/Qwen3.8-27B-GuCheng-KTO"
7
8quant = BitsAndBytesConfig(load_in_4bit=True, bnb_4bit_compute_dtype=torch.bfloat16,
9 bnb_4bit_quant_type="nf4", bnb_4bit_use_double_quant=True)
10model = AutoModelForCausalLM.from_pretrained(base, trust_remote_code=True,
11 torch_dtype=torch.bfloat16, device_map="auto",
12 quantization_config=quant)
13model = PeftModel.from_pretrained(model, adapter, is_trainable=False)
14processor = AutoProcessor.from_pretrained(base, trust_remote_code=True)
15model.eval()