Views
No views yet
1from transformers import AutoModelForSequenceClassification, AutoTokenizer
2
3model = AutoModelForSequenceClassification.from_pretrained("bikmish/llm-course-hw2-reward-model")
4tokenizer = AutoTokenizer.from_pretrained("bikmish/llm-course-hw2-reward-model")
5
6text_pair = [
7 "That's awesome! Tell me more details! 😄", # chosen
8 "I cannot provide opinions about entertainment." # rejected
9]
10
11inputs = tokenizer(text_pair, padding=True, return_tensors="pt")
12rewards = model(**inputs).logits
13print(f"Chosen: {rewards[0].item():.2f}, Rejected: {rewards[1].item():.2f}")