Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2import torch
3# Ensure CUDA is available
4device = 'cuda' if torch.cuda.is_available() else 'cpu'
5print(f"Using device: {device}")
6# Init Model
7model_path="Porameht/openthaigpt-7b-customer-support-th"
8tokenizer = AutoTokenizer.from_pretrained(model_path, trust_remote_code=True)
9model = AutoModelForCausalLM.from_pretrained(model_path, trust_remote_code=True, torch_dtype=torch.float16)
10model.to(device)
11# Prompt
12prompt = "ต้องการยกเลิกออเดอร์"
13llama_prompt = f"<s>[INST] <<SYS>>\nYou are a question answering assistant. Answer the question as truthful and helpful as possible คุณคือผู้ช่วยตอบคำถาม จงตอบคำถามอย่างถูกต้องและมีประโยชน์ที่สุด<</SYS>>\n\n{prompt} [/INST]"
14inputs = tokenizer.encode(llama_prompt, return_tensors="pt")
15inputs = inputs.to(device)
16# Generate
17outputs = model.generate(inputs, max_length=512, num_return_sequences=1)
18print(tokenizer.decode(outputs[0], skip_special_tokens=True))