Document and Chart Understanding on AI2D
85.2AccuracyMiMo-VL-7B +PC
Evaluation Results
| Method | Links | |
|---|---|---|
| MiMo-VL-7B +PCBackbone Model=MiMo-VL-7B, Training Paradigm (+PC)=Yes2026.03 | 85.2 | |
| Qwen2.5-VL-7B +PCBackbone Model=Qwen2.5-VL-7B, Training Paradigm (+PC)=Yes2026.03 | 84.7 | |
| DUELRole=Solver2026.05 | 84.2 | |
| Qwen2.5-VL-7BBackbone Model=Qwen2.5-VL-7B, Training Paradigm (+PC)=No2026.03 | 83.9 | |
| Vision-Zero(CLEVR)2026.05 | 83.7 | |
| VLAA-Thinker-7B2026.05 | 83.5 | |
| DUELRole=Challenger2026.05 | 83.5 | |
| EvoLMM2026.05 | 83.4 | |
| OpenVLThinker-7B2026.05 | 83.3 | |
| MiMo-VL-7BBackbone Model=MiMo-VL-7B, Training Paradigm (+PC)=No2026.03 | 83.2 | |
| MM-UPT2026.05 | 82.8 | |
| Qwen2.5-VL-7B2026.05 | 82.6 | |
| Qwen2.5-VL-3BBackbone Model=Qwen2.5-VL-3B, Training Paradigm (+PC)=No2026.03 | 81.6 | |
| Qwen2.5-VL-3B +PCBackbone Model=Qwen2.5-VL-3B, Training Paradigm (+PC)=Yes2026.03 | 81.4 | |
| Qwen2.5-Omni-3BModel Scale=3B2026.06 | 76.98 | |
| AVLM-2BModel Scale=2B2026.06 | 74 | |
| Gemma-4-E2B-itModel Scale=4B2026.06 | 24.84 |