Views
No views yet
1from transformers import AutoTokenizer, AutoModelForCausalLM
2import torch
3
4tokenizer = AutoTokenizer.from_pretrained("NXPKEN/qwen25-1.5b-imx93-lora")
5model = AutoModelForCausalLM.from_pretrained("NXPKEN/qwen25-1.5b-imx93-lora", torch_dtype=torch.float16, device_map="auto")
6
7messages = [{"role": "system", "content": "You are an i.MX93 SoC expert."}, {"role": "user", "content": "如何配置 LPUART3?"}]
8
9prompt = tokenizer.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
10inputs = tokenizer(prompt, return_tensors="pt")
11outputs = model.generate(**inputs, max_new_tokens=256, temperature=0.2)
12response = tokenizer.decode(outputs[0], skip_special_tokens=True)
13print(response)