Views
No views yet
| Metrics | Qwen2.5-32B-Instruct-CUDA-Nvidia | Qwen2.5-32B-Instruct-FlagOS-Nvidia |
|---|---|---|
| livebench_new | 0.516 | 0.504 |
| aime | 0.167 | 0.167 |
| GPQA(0-shot) | 0.403 | 0.395 |
| MMLUPro | 0.697 | 0.697 |
| MUSR | 0.577 | 0.570 |
| TheoremQA | 0.151 | 0.151 |
docker pull flagrelease-registry.cn-beijing.cr.aliyuncs.com/flagrelease/flagrelease:nv_vllm084_gems20250401release1pip install modelscope
2modelscope download --model Qwen/Qwen2.5-VL-32B-Instruct --local_dir /share/Qwen2.5-VL-32B-Instruct
31docker run --rm --init --detach \
2 --net=host --uts=host --ipc=host \
3 --security-opt=seccomp=unconfined \
4 --privileged=true \
5 --ulimit stack=67108864 \
6 --ulimit memlock=-1 \
7 --ulimit nofile=1048576:1048576 \
8 --shm-size=32G \
9 -v /share:/share \
10 --gpus all \
11 --name flagos \
12 flagrelease-registry.cn-beijing.cr.aliyuncs.com/flagrelease/flagrelease:nv_vllm084_gems20250401release \
13 sleep infinity
14
15docker exec -it flagos bashflagscale serve qwen2_5