Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3import torch
4
5base_model = "vngrs-ai/Kumru-2B"
6lora_path = "aiproje/kumru-2b-flirt-lora" # kendi repo adını yaz
7
8tokenizer = AutoTokenizer.from_pretrained(base_model)
9model = AutoModelForCausalLM.from_pretrained(
10 base_model,
11 load_in_4bit=True,
12 device_map="auto"
13)
14model = PeftModel.from_pretrained(model, lora_path)
15
16# Örnek sohbet
17prompt = "Nasılsın şekerim? 😏"
18inputs = tokenizer(prompt, return_tensors="pt").to("cuda")
19outputs = model.generate(
20 **inputs,
21 max_new_tokens=120,
22 temperature=0.85, # biraz daha yaratıcı
23 top_p=0.92,
24 repetition_penalty=1.2, # daha fazla tekrar
25 max_new_tokens=300,
26 repetition_penalty=1.25,
27 do_sample=True
28)
29print(tokenizer.decode(outputs[0], skip_special_tokens=True))