Views
No views yet
yoiko-Qwen3.5-4B-lora is a LoRA adapter package for Qwen/Qwen3.5-4B.Qwen/Qwen3.5-4Bdevice_map="auto"adapter_model.safetensorsadapter_config.jsonchat_template.jinjatokenizer.jsontokenizer_config.jsonREADME.mdLICENSE1from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
2from peft import PeftModel
3import torch
4
5base_model = "Qwen/Qwen3.5-4B"
6adapter_path = "yoikoarmor/yoiko-Qwen3.5-4B-lora"
7
8tokenizer = AutoTokenizer.from_pretrained(adapter_path, trust_remote_code=False)
9
10quant_config = BitsAndBytesConfig(
11 load_in_4bit=True,
12 bnb_4bit_quant_type="nf4",
13 bnb_4bit_compute_dtype=torch.bfloat16,
14 bnb_4bit_use_double_quant=True,
15)
16
17model = AutoModelForCausalLM.from_pretrained(
18 base_model,
19 device_map="auto",
20 quantization_config=quant_config,
21 torch_dtype=torch.bfloat16,
22 trust_remote_code=False,
23)
24
25model = PeftModel.from_pretrained(model, adapter_path, is_trainable=False)
26model.eval()