Views
No views yet
| Metrics | Qwen3-4B-H100-CUDA | Qwen3-4B-FlagOS-Nvidia |
|---|---|---|
| LIVEBENCH | 0.501 | 0.508 |
| AIME | 0.700 | 0.767 |
| GPQA | 0.410 | 0.444 |
| MMLU | 0.669 | 0.673 |
| MUSR | 0.590 | 0.602 |
| TheoremQA | 0.077 | 0.076 |
docker pull flagrelease-registry.cn-beijing.cr.aliyuncs.com/flagrelease/flagrelease:nv_vllm085_gemscbbf391pip install modelscope
2modelscope download --model Qwen/Qwen3-4B --local_dir /nfs/Qwen3-4B1docker run --rm --init --detach \
2 --net=host --uts=host --ipc=host \
3 --security-opt=seccomp=unconfined \
4 --privileged=true \
5 --ulimit stack=67108864 \
6 --ulimit memlock=-1 \
7 --ulimit nofile=1048576:1048576 \
8 --shm-size=32G \
9 -v /nfs:/nfs \
10 --gpus all \
11 --name flagos \
12 flagrelease-registry.cn-beijing.cr.aliyuncs.com/flagrelease/flagrelease:nv_vllm085_gemscbbf39 \
13 sleep infinity
14
15docker exec -it flagos bashflagscale serve qwen3