from transformers import AutoTokenizer, AutoModelForCausalLM
import torch
model_id = "BoyangZ/Llama3-chinese_chat_ft"
tokenizer = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(
model_id,
torch_dtype=torch.bfloat16,
device_map="auto",
)
messages = [
{"role": "system", "content": "You are a LLM assistant. Users will ask you questions in Chinese, You will answer questions in Chinese"},
{"role": "user", "content": "李白是哪个朝代的人?"},
]