Views
No views yet
1from transformers import GPT2LMHeadModel, GPT2Tokenizer
2import torch
3
4# Load model and tokenizer
5model = GPT2LMHeadModel.from_pretrained("Tanaybh/gpt2-rlhf-anthropic")
6tokenizer = GPT2Tokenizer.from_pretrained("Tanaybh/gpt2-rlhf-anthropic")
7tokenizer.pad_token = tokenizer.eos_token
8
9# Generate response
10prompt = "How can I improve my productivity?"
11inputs = tokenizer.encode(prompt, return_tensors="pt")
12
13with torch.no_grad():
14 outputs = model.generate(
15 inputs,
16 max_length=inputs.shape[1] + 50,
17 temperature=0.7,
18 do_sample=True,
19 pad_token_id=tokenizer.eos_token_id
20 )
21
22response = tokenizer.decode(outputs[0], skip_special_tokens=True)
23print(response[len(prompt):])1@misc{gpt2-rlhf-anthropic,
2 title={GPT-2 RLHF: Complete 3-Stage Training Pipeline},
3 author={Tanaybh},
4 year={2024},
5 url={https://huggingface.co/Tanaybh/gpt2-rlhf-anthropic},
6 note={Trained using Anthropic HH-RLHF dataset}
7}