Views
No views yet
1
2!pip install transformers peft accelerate bitsandbytes
3
4from peft import AutoPeftModelForCausalLM
5from transformers import AutoTokenizer
6
7model = AutoPeftModelForCausalLM.from_pretrained(
8 "Mollel/Gemma_Swahili_Mollel_1_epoch",
9 load_in_4bit = False
10)
11
12tokenizer = AutoTokenizer.from_pretrained("Mollel/Gemma_Swahili_Mollel_1_epoch")
13
14
15input_prompt = """
16### Instruction:
17{}
18
19### Input:
20{}
21
22### Response:
23{}"""
24
25
26
27input_text = input_prompt.format(
28 "Andika aya fupi kuhusu mada iliyotolewa.", # instruction
29 "Umuhimu wa kutumia nishati inayoweza kurejeshwa", # input
30 "", # output - leave this blank for generation!
31 )
32
33inputs = tokenizer([input_text], return_tensors = "pt").to("cuda")
34
35outputs = model.generate(**inputs, max_new_tokens = 300, use_cache = True)
36response = tokenizer.batch_decode(outputs)[0]
37
38print(response)
39