1from transformers import AutoTokenizer, AutoModelForCausalLM
2from peft import PeftModel
3import torch
4
5base_model_id = "google/gemma-3-4b-pt"
6adapter_id = "aigensa/gemma3-4b-ukrainian"
7
8tokenizer = AutoTokenizer.from_pretrained(adapter_id)
9model = AutoModelForCausalLM.from_pretrained(
10 base_model_id,
11 torch_dtype=torch.bfloat16,
12 device_map="auto",
13)
14model = PeftModel.from_pretrained(model, adapter_id)
15model.eval()
16
17inputs = tokenizer("Розкажи про Україну:", return_tensors="pt").to(model.device)
18outputs = model.generate(**inputs, max_new_tokens=200)
19print(tokenizer.decode(outputs[0], skip_special_tokens=True))