1import torch
2from transformers import AutoTokenizer, AutoModelForCausalLM
3
4model_id = "shalinm/Kemcho-Gemma-3-1B-IT"
5
6tokenizer = AutoTokenizer.from_pretrained(model_id, use_fast=True)
7model = AutoModelForCausalLM.from_pretrained(
8 model_id,
9 torch_dtype=torch.bfloat16,
10 device_map="auto",
11)
12
13messages = [
14 {"role": "system", "content": "તમે મદદરૂપ ગુજરાતી સહાયક છો."},
15 {"role": "user", "content": "આપેલ વાક્યોને એક વાક્યમાં ભેગા કરો.\n\nહું કામ માટે મોડો પડ્યો હતો. મારે મારા બાળકોને શાળાએ લઈ જવાનું હતું."},
16]
17
18inputs = tokenizer.apply_chat_template(
19 messages,
20 add_generation_prompt=True,
21 return_tensors="pt",
22).to(model.device)
23
24outputs = model.generate(
25 inputs,
26 max_new_tokens=256,
27 do_sample=True,
28 temperature=0.7,
29 top_p=0.9,
30)
31print(tokenizer.decode(outputs[0], skip_special_tokens=True))