Views
No views yet
unsloth/qwen2.5-coder-14b-instruct-bnb-4bit.unsloth/qwen2.5-coder-14b-instruct-bnb-4bittransformers + peft1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base_model = "unsloth/qwen2.5-coder-14b-instruct-bnb-4bit"
6adapter_model = "kkk0123k/gremlin_gwen_14B_lora_model"
7
8tokenizer = AutoTokenizer.from_pretrained(base_model)
9model = AutoModelForCausalLM.from_pretrained(base_model, device_map="auto", torch_dtype=torch.float16)
10model = PeftModel.from_pretrained(model, adapter_model)
11
12inputs = tokenizer("Convert natural language to a Gremlin query: Get all people who know someone named Alice.", return_tensors="pt").to("cuda")
13outputs = model.generate(**inputs, max_new_tokens=128)
14print(tokenizer.decode(outputs[0], skip_special_tokens=True))