Multimodal Reasoning on MATH-Vision (full)
62.7AccuracyQwen3-VL-8B-Thinking
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen3-VL-8B-ThinkingModel Type=Reasoning2025.12 | 62.7 | |
| Qwen3-VL-8B-Instruct + CAREBackbone=Qwen3-VL-8B-Instruct, Method=CARE2025.12 | 61.7 | |
| MiMo-VL-7B-RLModel Type=Reasoning2025.12 | 60.4 | |
| Qwen3-VL-4B-ThinkingModel Type=Reasoning2025.12 | 60 | |
| GPT-5-NanoModel Type=Proprietary2025.12 | 59.7 | |
| MiMo-VL-7B-SFTModel Type=Instruct2025.12 | 57.9 | |
| Qwen3-VL-8B-InstructModel Type=Instruct2025.12 | 53.9 | |
| Qwen3-VL-4B-InstructModel Type=Instruct2025.12 | 51.6 | |
| Gemini-2.0-ProModel Type=Proprietary2025.12 | 48.1 | |
| InternVL3.5-8B-InstructModel Type=Instruct2025.12 | 46.4 | |
| InternVL3.5-8B-MPOModel Type=Reasoning2025.12 | 46.4 | |
| Keye-VL-1.5-8BModel Type=Reasoning2025.12 | 46 | |
| Claude-Sonnet-3.7Model Type=Proprietary2025.12 | 41.9 | |
| Qwen2.5-VL-7B + CAREBackbone=Qwen2.5-VL-7B, Method=CARE2025.12 | 32.6 | |
| Qwen2.5-VL-7B + GSPOBackbone=Qwen2.5-VL-7B, RL Method=GSPO2025.12 | 31.6 | |
| M2-ReasoningModel Type=Reasoning2025.12 | 31.5 | |
| GPT-4o2025.07 | 30.3 | |
| Qwen2.5-VL-7B + DAPOBackbone=Qwen2.5-VL-7B, RL Method=DAPO2025.12 | 29.4 | |
| D2IparReasoning Strategy=D2I, Variant=par, Backbone=Qwen2.5-VL-7B2025.07 | 27.2 | |
| DeepEyesModel Type=Reasoning2025.12 | 26.6 | |
| D2IlocReasoning Strategy=D2I, Variant=loc, Backbone=Qwen2.5-VL-7B2025.07 | 26.3 | |
| Qwen2.5-VL-7B + GRPOBackbone=Qwen2.5-VL-7B, RL Method=GRPO2025.12 | 25.7 | |
| LLaVA-OneVision-1.5 8BModel Type=Instruct2025.12 | 25.6 | |
| OpenVLThinker-7B2025.07 | 25.3 | |
| Qwen2.5-VL-3B + CAREBackbone=Qwen2.5-VL-3B, Method=CARE2025.12 | 25 | |
| GPT-4V2025.07 | 22.7 | |
| Qwen2.5-VL-7B w/ GRPOReasoning Mode=Deliberate, Backbone=Qwen2.5-VL-7B2025.07 | 22.5 | |
| Qwen2.5-VL-7BModel Type=Instruct2025.12 | 22.4 | |
| Qwen2.5-VL-7B*Backbone=Qwen2.5-VL-7B2025.07 | 21.3 | |
| Qwen2.5-VL-3BModel Type=Instruct2025.12 | 21.2 | |
| D2DjusReasoning Strategy=D2D, Variant=jus, Backbone=Qwen2.5-VL-7B2025.07 | 20.1 | |
| D2DlocReasoning Strategy=D2D, Variant=loc, Backbone=Qwen2.5-VL-7B2025.07 | 20 | |
| InternVL2.5-8B2025.07 | 19.7 | |
| D2IjusReasoning Strategy=D2I, Variant=jus, Backbone=Qwen2.5-VL-7B2025.07 | 19.7 | |
| Qwen2.5-VL-7B w/ GRPO†Reasoning Mode=Intuitive, Backbone=Qwen2.5-VL-7B2025.07 | 18.8 | |
| InternVL2-8B2025.07 | 18.4 | |
| D2DparReasoning Strategy=D2D, Variant=par, Backbone=Qwen2.5-VL-7B2025.07 | 17.6 | |
| Qwen2-VL-7B2025.07 | 16.3 |