Views
No views yet
TinyStories dataset. This model serves as a baseline pipeline experiment for handling custom architecture initialization, offline dataset tokenization, and processing on hardware acceleration via an NVIDIA A10 GPU workstation.roneneldan/TinyStories1from transformers import AutoTokenizer, AutoModelForCausalLM
2
3tokenizer = AutoTokenizer.from_pretrained("agentbyumer/TinyTale-15M")
4model = AutoModelForCausalLM.from_pretrained("agentbyumer/TinyTale-15M")
5
6prompt = "Once upon a time, a small puppy found a shiny key"
7inputs = tokenizer(prompt, return_tensors="pt")
8
9output = model.generate(**inputs, max_length=100, do_sample=True, temperature=0.8)
10print(tokenizer.decode(output[0], skip_special_tokens=True))