Views
No views yet
unsloth/gemma-2-2b-it-bnb-4bit, an instruction-tuned Gemma 2B model in 4-bit quantization.unsloth/gemma-2-2b-it-bnb-4bit1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4base_model = "unsloth/gemma-2-2b-it-bnb-4bit"
5adapter = "Jabr7/Mini-Boni"
6
7tokenizer = AutoTokenizer.from_pretrained(base_model)
8model = AutoModelForCausalLM.from_pretrained(base_model, device_map="auto")
9model = PeftModel.from_pretrained(model, adapter)
10
11prompt = "Hola, ¿cómo estás?"
12inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
13outputs = model.generate(**inputs, max_new_tokens=100)
14print(tokenizer.decode(outputs[0], skip_special_tokens=True))