Views
No views yet

lora_alpha: 128lora_dropout: 0.05r: 64target_modules: "all-linear"lora_alpha: 128lora_dropout: 0.05r: 256target_modules: "all-linear"1
2from transformers import AutoModelForCausalLM, AutoTokenizer
3
4device = "cuda" # the device to load the model onto
5
6model = AutoModelForCausalLM.from_pretrained("TURKCELL/Turkcell-LLM-7b-v1")
7tokenizer = AutoTokenizer.from_pretrained("TURKCELL/Turkcell-LLM-7b-v1")
8
9messages = [
10 {"role": "user", "content": "Türkiye'nin başkenti neresidir?"},
11]
12
13encodeds = tokenizer.apply_chat_template(messages, return_tensors="pt")
14
15eos_token = tokenizer("<|im_end|>",add_special_tokens=False)["input_ids"][0]
16
17model_inputs = encodeds.to(device)
18model.to(device)
19
20generated_ids = model.generate(model_inputs,
21 max_new_tokens=1024,
22 do_sample=True,
23 eos_token_id=eos_token)
24
25decoded = tokenizer.batch_decode(generated_ids)
26print(decoded[0])
27
28
29