Views
No views yet
1import torch
2from transformers import AutoTokenizer
3# download model.py and pytorch_model.bin manually or via hf_hub_download
4from model import GPT, GPTConfig
5
6device = 'cuda' if torch.cuda.is_available() else 'cpu'
7
8tokenizer = AutoTokenizer.from_pretrained("rudyon/rudygpt")
9model = GPT(GPTConfig(depth=12, vocab_size=50304))
10state_dict = torch.load("pytorch_model.bin", map_location=device)
11model.load_state_dict(state_dict)
12model.eval()
13print(model.generate("Hello!"))