Views
No views yet
--kv-cache-dtype fp8" when loading, requires a compatible vLLM version).1set VIDEO_MAX_PIXELS=200704
2set FPS=2.0
3set FPS_MAX_FRAMES=2590
4set FPS_MIN_FRAMES=4
5set FORCE_QWENVL_VIDEO_READER=torchcodec
6
7python -m vllm.entrypoints.openai.api_server ^
8 --model /path/to/your/model/HuiHui-Qwen3.5-9B-abliterated-AWQ-W4A16 ^
9 --served-model-name HuiHui-Qwen3.5-9B-abliterated-AWQ-W4A16 ^
10 --trust-remote-code ^
11 --enforce-eager ^
12 --dtype auto ^
13 --max-model-len 262144 ^
14 --kv-cache-dtype fp8 ^
15 --gpu-memory-utilization 0.92 ^
16 --port 8000 ^
17 --allowed-local-media-path /path/to/your/media