Views
No views yet
google/gemma-4-E4B-it-qat-q4_0-unquantized.1from unsloth import FastLanguageModel
2from peft import PeftModel
3
4model, processor = FastLanguageModel.from_pretrained(
5 "google/gemma-4-E4B-it-qat-q4_0-unquantized",
6 max_seq_length=2048,
7 load_in_4bit=True,
8)
9model = PeftModel.from_pretrained(model, "Finn-Technologies/e1")
10
11messages = [
12 {"role": "system", "content": "You are e1, an AI model created by Finn Organization."},
13 {"role": "user", "content": "Your prompt here"},
14]
15text = processor.tokenizer.apply_chat_template(messages, tokenize=True, add_generation_prompt=True)
16outputs = model.generate(**processor(text, return_tensors="pt"), max_new_tokens=200)
17print(processor.decode(outputs[0]))