Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2
3model_name = "azherali/Riazi-8B-CPT"
4
5# load the tokenizer and the model
6tokenizer = AutoTokenizer.from_pretrained(model_name)
7model = AutoModelForCausalLM.from_pretrained(
8 model_name,
9 torch_dtype="auto",
10 device_map="auto"
11)
12
13# prepare the model input
14prompt = "پاکستان کی ثقافت کے بارے میں مختصر وضاحت کریں۔"
15messages = [
16 {"role": "user", "content": prompt}
17]
18
19text = tokenizer.apply_chat_template(
20 messages,
21 tokenize=False,
22 add_generation_prompt=True,
23)
24
25model_inputs = tokenizer([text], return_tensors="pt").to(model.device)
26
27# conduct text completion
28generated_ids = model.generate(
29 **model_inputs,
30 max_new_tokens=2048
31)
32
33output_ids = generated_ids[0][len(model_inputs.input_ids[0]):].tolist()
34
35try:
36 # rindex finding 151668 (</think>)
37 index = len(output_ids) - output_ids[::-1].index(151668)
38except ValueError:
39 index = 0
40
41
42content = tokenizer.decode(
43 output_ids[index:],
44 skip_special_tokens=True
45).strip("\n")
46
47print("content:", content)