Views
No views yet
1# Create a dedicated python env
2python3 -m venv llmcompressor
3source llmcompressor/bin/activate
4# Install llm-compressor and additionnal needed libs
5pip install llmcompressor qwen_vl_utils torchvision
6# Download model in HF cache
7hf download Qwen/Qwen2.5-VL-7B-Instruct
8# Start quantization
9wget https://github.com/vllm-project/llm-compressor/blob/main/examples/quantization_w8a8_fp8/qwen_2_5_vl_example.py -O qwen_2_5_vl_fp8.py
10python3 qwen_2_5_vl_fp8.py