Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4repo_id = "iko-01/iko_im3"
5
6# بدل REPO_BASE باللي درّبت عليه أول مرة (مثلاً gpt2 أو iko-01/iko-v5e-1)
7base_repo = "iko-01/iko-v5e-1"
8
9tokenizer = AutoTokenizer.from_pretrained(base_repo)
10model = AutoModelForCausalLM.from_pretrained(repo_id)
11model.to("cpu")
12
13def ask_model(question, max_new_tokens=1000):
14 prompt = f"### User:\n{question.strip()}\n\n### Assistant:\n"
15 inputs = tokenizer(prompt, return_tensors="pt", truncation=True, padding=True, max_length=1024)
16 with torch.no_grad():
17 gen = model.generate(
18 inputs.input_ids,
19 attention_mask=inputs.attention_mask,
20 max_new_tokens=max_new_tokens,
21 do_sample=True,
22 top_p=0.95,
23 temperature=0.9,
24 pad_token_id=tokenizer.pad_token_id,
25 eos_token_id=tokenizer.eos_token_id,
26 )
27 out = tokenizer.decode(gen[0], skip_special_tokens=True)
28 if "### Assistant:" in out:
29 return out.split("### Assistant:")[-1].strip()
30 return out
31
32print(ask_model("what is API"))