Views
No views yet
1pip install lmms-eval==0.2.0
2
3CUDA_VISIBLE_DEVICES=0,1,2,3,4,5,6,7 \
4python -m accelerate.commands.launch \
5 --main_process_port=12581 \
6 --num_processes=8 \
7 -m lmms_eval \
8 --model llava \
9 --model_args pretrained=DeepGlint-AI/llava-mlcd-qwen2.5-7b,conv_template=qwen_1_5 \
10 --tasks mmbench,mme,mmmu,ocrbench,scienceqa,scienceqa_img,seedbench,gqa,pope,textvqa_val,ai2d,chartqa,docvqa_val,infovqa_val,mmstar \
11 --batch_size 1 \
12 --log_samples \
13 --log_samples_suffix mlcd_llava_qwen2_7b \
14 --output_path ./log| Vision Tower | MLCD (ViT_L_14_336px) | CLIP (ViT_L_14_336px) |
|---|---|---|
| LLM | Qwen2.5-7B | Qwen2.5-7B |
| AI2D | 76.98 | 73.15 |
| ScienceQA_img | 78.09 | 76.35 |
| GQA | 64.17 | 63.31 |
| InfoVQA_val | 43.48 | 38.88 |
| MMBench_cn_dev | 74.83 | 72.51 |
| MMBench_en_dev | 76.37 | 74.57 |
| MME(cognition) | 432 | 384 |
| MME(perception) | 1598 | 1512 |
| SeedBench | 68.20 | 66.80 |
| SeedBench_img | 73.75 | 72.72 |
| MMStar | 50.98 | 48.98 |
| MMMU | 44.30 | 44.20 |
| OCRBench | 531.00 | 525.00 |
| ChartQA | 67.84 | 66.52 |
| DocVQA_val | 76.46 | 75.21 |
| POPE | 88.69 | 88.83 |
| TextVQA_val | 61.69 | 62.47 |