Views
No views yet
1import torch
2from peft import PeftModel
3from transformers import AutoModelForCausalLM, AutoTokenizer
4
5tok = AutoTokenizer.from_pretrained("Werea-co/Werea-LLM-3B")
6model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen2.5-3B-Instruct",
7 torch_dtype=torch.bfloat16, device_map="cuda")
8model = PeftModel.from_pretrained(model, "Werea-co/Werea-LLM-3B")
9
10msgs = [{"role": "user", "content": "Yapay zeka nedir?"}]
11text = tok.apply_chat_template(msgs, tokenize=False, add_generation_prompt=True)
12ids = tok(text, return_tensors="pt").to("cuda")
13out = model.generate(**ids, max_new_tokens=256)
14print(tok.decode(out[0, ids["input_ids"].shape[1]:], skip_special_tokens=True))