Views
No views yet
v4_base.pt: Pretraining sonrası (continuation/completion)v4_instruct.pt: SFT sonrası (ChatML format)1import torch
2from model_v4 import GPTV4, GPTConfigV4
3from tokenizers import Tokenizer
4
5ckpt = torch.load("v4_base.pt", weights_only=False)
6cfg = GPTConfigV4(**ckpt["config"])
7model = GPTV4(cfg).cuda()
8model.load_state_dict(ckpt["model"])
9model.eval()
10
11tok = Tokenizer.from_file("tokenizer-tr-16k.json")
12ids = tok.encode("Bu çalışmada, ").ids
13x = torch.tensor([ids]).cuda()
14out = model.generate(x, max_new_tokens=200, temperature=0.8, top_k=50,
15 repetition_penalty=1.15)
16print(tok.decode(out[0].tolist()))