Mathematical Reasoning on MathVista (Accuracy %)
75.2Accuracy (%)EASE-7B
Evaluation Results
| Method | Links | |
|---|---|---|
| EASE-7BModel Scale=7B2026.05 | 75.2 | |
| VGPO-7BModel Scale=7B2026.05 | 74.1 | |
| ThinkLite-VL-7BModel Scale=7B2026.05 | 73.6 | |
| NoisyRollout-7BModel Scale=7B2026.05 | 72.9 | |
| PAPO_D-7BModel Scale=7B2026.05 | 72.3 | |
| Vision-Zero(CLEVR)2026.05 | 70.6 | |
| VPPO-RL-7BModel Scale=7B2026.05 | 70.5 | |
| DUELRole=Solver2026.05 | 69.8 | |
| EvoLMM2026.05 | 69.7 | |
| IVR-R1Backbone model=Qwen3-VL-4B2026.05 | 69.6 | |
| MM-UPT2026.05 | 69.4 | |
| OpenVLThinker-7B2026.05 | 68.9 | |
| Qwen3-VL-32B-InstructBackbone model=Qwen3-VL-32B-Instruct2026.05 | 68.7 | |
| DUELRole=Challenger2026.05 | 68.6 | |
| Qwen2.5-VL-7B2026.05 | 68.4 | |
| Vision-R1Backbone model=Qwen3-VL-4B2026.05 | 68.3 | |
| Vision-SR1Backbone model=Qwen3-VL-4B2026.05 | 68.2 | |
| VLAA-Thinker-7B2026.05 | 68.2 | |
| IVR-R1Backbone model=Qwen2.5-VL-7B2026.05 | 67.9 | |
| Vision-R1Backbone model=Qwen2.5-VL-7B2026.05 | 67.4 | |
| MM-Eureka-7BModel Scale=7B2026.05 | 66.3 | |
| Supervised Fine-tuning (before RL)Backbone model=Qwen3-VL-4B2026.05 | 65.6 | |
| VL-Rethinker-7BModel Scale=7B2026.05 | 65.2 | |
| Supervised Fine-tuning (before RL)Backbone model=Qwen2.5-VL-7B2026.05 | 63.6 | |
| Vision-SR1Backbone model=Qwen2.5-VL-7B2026.05 | 63.5 | |
| Zero-shot Inference (before RL)Backbone model=Qwen3-VL-4B2026.05 | 54.5 | |
| Qwen2.5-VL-72B-InstructBackbone model=Qwen2.5-VL-72B-Instruct2026.05 | 48.1 | |
| Qwen2.5-VL-32B-InstructBackbone model=Qwen2.5-VL-32B-Instruct2026.05 | 37.2 | |
| Zero-shot Inference (before RL)Backbone model=Qwen2.5-VL-7B2026.05 | 32.6 |