Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4# Load base model
5base_model = AutoModelForCausalLM.from_pretrained(
6 "Qwen/Qwen2.5-3B-Instruct",
7 device_map="auto",
8 torch_dtype="auto"
9)
10
11# Load LoRA adapter
12model = PeftModel.from_pretrained(base_model, "nullvektordom/sysbreak-grid-runner-lora")
13tokenizer = AutoTokenizer.from_pretrained("nullvektordom/sysbreak-grid-runner-lora")
14
15# Generate
16prompt = "Generate cyberpunk content"
17inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
18outputs = model.generate(**inputs, max_new_tokens=512)
19print(tokenizer.decode(outputs[0], skip_special_tokens=True))