Views
No views yet
1vllm serve brandonbeiler/InternVL3_5-8B-FP8-Dynamic \
2 --quantization compressed-tensors \
3 --served-model-name internvl3_5-8b \
4 --reasoning-parser qwen3 \
5 --trust-remote-code \
6 --max-model-len 32768 \
7 --tensor-parallel-size 1 # Adjust based on your GPU setupllmcompressor==0.7.1
compressed-tensors==0.10.2
transformers==4.55.0
torch==2.7.1
vllm==0.10.1.1