Views
No views yet
| Detail | Value |
|---|---|
| Base / target model | Qwen/Qwen2.5-0.5B |
| Draft architecture | 1 LLaMA-style decoder layer (~30 M trainable params) |
| TTT steps | 8 |
| Draft tokens | 4 |
| Training samples | 100 000 (random-token prompts + greedy completions) |
| Epochs | 5 |
| Learning rate | 5 × 10⁻⁵ (cosine schedule) |
| Sequence length | 1 024 |
| Framework | speculators ≥ 0.5.0 |
1vllm serve Qwen/Qwen2.5-0.5B \
2 --speculative-model BalajiAI/qwen2.5-0.5b.eagle3 \
3 --num-speculative-tokens 4 \
4 --dtype bfloat16