Views
No views yet
1import torch
2from Model import LLM, params
3import tiktoken
4
5# Load tokenizer
6tokenizer = tiktoken.get_encoding("gpt2")
7
8# Load model
9device = "cuda" if torch.cuda.is_available() else "cpu"
10model = LLM(params, tokenizer, device)
11model.load_state_dict(torch.load("best_model_state-114m.bin"))
12model.eval()
13
14# Generate text
15output = model.generate(
16 "Hello, I am",
17 max_gen_len=50,
18 temperature=0.6,
19 top_p=0.9,
20 top_k=32
21)
22print(output)