Universal Kaggle-ready training notebook for the Cosmos T2-Accelerate-beta series.
1import torch
2from transformers import AutoTokenizer
3
4from app import CosmosT2_Accelerate_LLM
5
6tokenizer = AutoTokenizer.from_pretrained("Qwen/Qwen2.5-0.5B")
7if tokenizer.pad_token is None:
8 tokenizer.pad_token = tokenizer.eos_token
9
10ckpt = torch.load("$CHECKPOINT_NAME", map_location="cpu")
11model = CosmosT2_Accelerate_LLM(**ckpt["config"])
12model.load_state_dict(ckpt["model_state"])
13model.eval()
14
15prompt = tokenizer.apply_chat_template(
16 [
17 {"role": "system", "content": "Enable thinking features: INTUITION"},
18 {"role": "user", "content": "What is 12 * 7?"},
19 ],
20 tokenize=False,
21 add_generation_prompt=True,
22)
23ids = tokenizer(prompt, return_tensors="pt", add_special_tokens=False).input_ids
24out = model.generate(ids, max_new_tokens=120, temperature=0.8, top_k=50)
25print(tokenizer.decode(out[0], skip_special_tokens=False))
Use the Qwen2.5 chat template. The default system prompt is:
This notebook is designed to train future Cosmos T2-Accelerate-beta variants by changing only the config block at the top.
1@misc{cosmos-t2,
2 author = {wop},
3 title = {Cosmos-T2: A small from-scratch chain-of-thought Transformer},
4 year = {2026},
5 publisher = {Hugging Face},
6 url = {https://huggingface.co/wop/Cosmos-T2-Accelerate-beta}
7}