Views
No views yet
1vllm serve openai/gpt-oss-120b \
2 --tensor-parallel-size 4 \
3 --speculative-config '{
4 "model": "stevenabreu7/gpt-oss-120b-speculator.eagle3",
5 "num_speculative_tokens": 5,
6 "method": "eagle3"
7 }' \
8 --no-enable-prefix-caching \
9 --max-num-seqs 64 \
10 --enforce-eager