Views
No views yet
1from transformers import AutoModelForCausalLM, AutoTokenizer
2from peft import PeftModel
3
4# 1. Load the base model and tokenizer
5base_model_id = "aisingapore/Llama-SEA-LION-v3-8B-IT"
6tokenizer = AutoTokenizer.from_pretrained(base_model_id)
7base_model = AutoModelForCausalLM.from_pretrained(base_model_id, device_map="auto", torch_dtype="auto")
8
9# 2. Load your fine-tuned adapter
10adapter_id = "jenniemoonsunset123/khmer-rag-model"
11model = PeftModel.from_pretrained(base_model, adapter_id)
12
13# 3. Test it!
14prompt = "សួស្តី! តើអ្នកអាចជួយខ្ុំបានទេ?"
15inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
16outputs = model.generate(**inputs, max_new_tokens=100)
17print(tokenizer.decode(outputs[0], skip_special_tokens=True))