Views
No views yet
1# pip install optimum[openvino]
2from transformers import AutoTokenizer
3from optimum.intel import OVModelForCausalLM
4
5model_path = "helenai/ibm-granite-granite-8b-code-instruct-ov"
6tokenizer = AutoTokenizer.from_pretrained(model_path)
7model = OVModelForCausalLM.from_pretrained(model_path)
8
9# change input text as desired
10chat = [
11 { "role": "user", "content": "Write a code to find the maximum value in a list of numbers." },
12]
13chat = tokenizer.apply_chat_template(chat, tokenize=False, add_generation_prompt=True)
14# tokenize the text
15input_tokens = tokenizer(chat, return_tensors="pt")
16# generate output tokens
17output = model.generate(**input_tokens, max_new_tokens=100)
18# decode output tokens into text
19output = tokenizer.batch_decode(output)
20# loop over the batch to print, in this example the batch size is 1
21for i in output:
22 print(i)