Views
No views yet
FF-125M is a compact, didactic LLM trained from scratch to reproduce
GPT-2-style behavior while maintaining modern training stability.1from transformers import GPT2LMHeadModel, GPT2TokenizerFast
2model = GPT2LMHeadModel.from_pretrained("francescofiamingo1/ff-125m-cloud")
3tokenizer = GPT2TokenizerFast.from_pretrained("francescofiamingo1/ff-125m-cloud")
4
5prompt = "In a surprising discovery,"
6inputs = tokenizer(prompt, return_tensors="pt")
7outputs = model.generate(**inputs, max_new_tokens=60)
8print(tokenizer.decode(outputs[0], skip_special_tokens=True))
9
10