Views
No views yet
| Metric | BASE | MID | SFT | RL |
|---|---|---|---|---|
| ARC-Challenge | - | 0.5367 | 0.5418 | - |
| ARC-Easy | - | 0.6961 | 0.7210 | - |
| GSM8K | - | 0.1137 | 0.1327 | - |
| HumanEval | - | 0.1098 | 0.1037 | - |
| MMLU | - | 0.4229 | 0.4304 | - |
| ChatCORE | - | 0.4045 | 0.4157 | - |
├── tokenizer/
│ ├── tokenizer.pkl # Tokenizer
│ └── token_bytes.pt # Token byte mappings
├── mid_checkpoints/d34/ # Mid-training checkpoint
│ ├── model_*.pt
│ └── meta_*.json
├── chatsft_checkpoints/d34/ # SFT checkpoint
│ ├── model_*.pt
│ └── meta_*.json
├── chatsft_checkpoints_int8/d34/ # SFT checkpoint
│ ├── model_*.pt
│ └── meta_*.json
├── chatrl_checkpoints/d34/ # RL checkpoint (if available)
│ ├── model_*.pt
│ └── meta_*.json
├── report/ # Evaluation reports
│ └── report.md
└── logs/ # Training logs1@misc{nanochat,
2 author = {Andrej Karpathy},
3 title = {nanochat: The best ChatGPT that $100 can buy},
4 year = {2025},
5 publisher = {GitHub},
6 url = {https://github.com/karpathy/nanochat}
7}