Views
No views yet
Qwen/Qwen2.5-Coder-7B-Instruct using optimum-intel
via the export space.pip install optimum[openvino]1from optimum.intel.openvino import OVModelForCausalLM
2from transformers import AutoTokenizer
3
4model_dir = "MaliJa/Qwen2.5-Coder-7B-Instruct-openvino"
5
6tokenizer = AutoTokenizer.from_pretrained(model_dir)
7model = OVModelForCausalLM.from_pretrained(
8 model_dir,
9 device="GPU",
10)
11
12prompt = "What is OpenVINO?"
13
14inputs = tokenizer(prompt, return_tensors="pt")
15outputs = model.generate(**inputs, max_new_tokens=200)
16
17print(tokenizer.decode(outputs[0], skip_special_tokens=True))