Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2model = AutoModelForCausalLM.from_pretrained("thangvip/vwen-1.5B-instruct", device_map="auto", cache_dir="./cache").eval()
3tokenizer = AutoTokenizer.from_pretrained("thangvip/vwen-1.5B-instruct", cache_dir="./cache")
4
5messages = [
6 {'role': 'system', 'content': "bạn là trợ lý AI hữu ích"},
7 {"role": "user", "content": "Nước nào có diện tích lớn nhất?"},
8]
9text = tokenizer.apply_chat_template(messages, add_generation_prompt=True, tokenize=False)
10inputs = tokenizer(text, return_tensors="pt")
11inputs = {k: v.to("cuda") for k, v in inputs.items()}
12
13outputs = model.generate(**inputs, tokenizer=tokenizer, max_new_tokens=256, do_sample=True, top_p=0.95, temperature=0.1, repetition_penalty=1.2, eos_token_id=tokenizer.eos_token_id, stop_strings=['<|im_end|>'])
14print(tokenizer.decode(outputs[0]))