Views
No views yet
2e-64216230000.20.021.01from transformers import AutoModelForCausalLM, AutoTokenizer
2
3# Load your PPO model
4print("📦 Loading your model...")
5model = AutoModelForCausalLM.from_pretrained("HYDARIM7/SmolLM2_RLHF_PPO_HY")
6tokenizer = AutoTokenizer.from_pretrained("HYDARIM7/SmolLM2_RLHF_PPO_HY")
7print("✅ Model loaded!\n")
8
9# Ask a few questions
10questions = [
11 "What is your name?",
12 "How are you today?",
13 "What can you help me with?",
14 "Tell me about yourself.",
15]
16
17print("🤖 Testing your PPO model:\n")
18print("="*60)
19
20for question in questions:
21 print(f"\n❓ Question: {question}")
22
23 # Generate answer
24 inputs = tokenizer(question, return_tensors="pt")
25 outputs = model.generate(
26 **inputs,
27 max_length=100,
28 temperature=0.7,
29 do_sample=True,
30 top_p=0.9,
31 pad_token_id=tokenizer.pad_token_id if tokenizer.pad_token_id else tokenizer.eos_token_id
32 )
33
34 answer = tokenizer.decode(outputs[0], skip_special_tokens=True)
35 print(f"💬 Answer: {answer}")
36 print("-"*60)
37
38print("\n✅ Test complete!")