Multi-modal Reasoning on MathVision (test)
47.7Accuracy (%)Nanobanana-Pro
Evaluation Results
| Method | Links | |
|---|---|---|
| Nanobanana-ProData Filtration=Filt2026.01 | 47.7 | |
| Qwen-ImageData Filtration=Filt2026.01 | 47 | |
| Qwen-ImgcoderSynthesis Strategy=ImgCoder, Base Model=Qwen2026.01 | 46.9 | |
| Gemini-ImgCoderSynthesis Strategy=ImgCoder, Base Model=Gemini2026.01 | 46.9 | |
| Nanobanana-Pro2026.01 | 46.1 | |
| Qwen-Image2026.01 | 45.9 | |
| Gemini-2.0-Flash2026.02 | 41.3 | |
| Base2026.01 | 39 | |
| Qwen2.5-VL-72BModel Category=General Multimodal LLM, Parameters=72B2025.12 | 38.1 | |
| SFT-MModel=Qwen2.5-VL-7B, Paradigm=SFT-M2026.02 | 32.96 | |
| SRPO-7BModel Category=Reasoning Multimodal LLM, Parameters=7B2025.12 | 32.9 | |
| ThinkOmniBase Model=Qwen2.5-Omni-7B, LRM Guide=Qwen32026.02 | 32.9 | |
| GRPOModel=Qwen2.5-VL-7B, Paradigm=GRPO2026.02 | 32.83 | |
| VL-Rethinker-7BModel Category=Reasoning Multimodal LLM, Parameters=7B2025.12 | 32.3 | |
| SFT-RSModel=Qwen2.5-VL-7B, Paradigm=SFT-RS2026.02 | 32.25 | |
| SFTModel=Qwen2.5-VL-7B, Paradigm=SFT2026.02 | 32.11 | |
| SFT-MModel=Qwen2.5-VL-3B, Paradigm=SFT-M2026.02 | 31.92 | |
| ThinkOmniBase Model=Omni-R1-7B, LRM Guide=Qwen32026.02 | 31.5 | |
| GPT-4o2026.02 | 30.4 | |
| ReLaX-VL-7BModel Category=Reasoning Multimodal LLM, Parameters=7B2025.12 | 30.2 | |
| GRPOModel=Qwen2.5-VL-3B, Paradigm=GRPO2026.02 | 29.96 | |
| SFT-RSModel=Qwen2.5-VL-3B, Paradigm=SFT-RS2026.02 | 29.83 | |
| SFTModel=Qwen2.5-VL-3B, Paradigm=SFT2026.02 | 29.5 | |
| ThinkOmniBase Model=Qwen2.5-Omni-7B, LRM Guide=DeepSeek2026.02 | 28.2 | |
| ReLaX-VL-3BModel Category=Reasoning Multimodal LLM, Parameters=3B2025.12 | 27.6 | |
| Vision-R1-7BModel Category=Reasoning Multimodal LLM, Parameters=7B2025.12 | 27.2 | |
| ThinkOmniBase Model=Omni-R1-7B, LRM Guide=DeepSeek2026.02 | 27 | |
| MM-Eureka-7BModel Category=Reasoning Multimodal LLM, Parameters=7B2025.12 | 26.9 | |
| Omni-R1Notes=Evaluated using authors' scripts2026.02 | 25.4 | |
| HumanOmniV2Notes=Evaluated using authors' scripts2026.02 | 25.4 | |
| Omni-R12026.02 | 25.4 | |
| OpenVLThinker-7BModel Category=Reasoning Multimodal LLM, Parameters=7B2025.12 | 25.3 | |
| ThinkOmniBase Model=Qwen2.5-Omni-3B, LRM Guide=Qwen32026.02 | 25.3 | |
| Qwen2.5-VL-7BModel Category=General Multimodal LLM, Parameters=7B2025.12 | 25.1 | |
| Qwen2.5-Omni-7B2026.02 | 25 | |
| R1-VL-7BModel Category=Reasoning Multimodal LLM, Parameters=7B2025.12 | 24.7 | |
| MM-Eureka-8BModel Category=Reasoning Multimodal LLM, Parameters=8B2025.12 | 22.2 | |
| Kimi-VL-16BModel Category=General Multimodal LLM, Parameters=16B2025.12 | 21.4 | |
| Qwen2.5-VL-3BModel Category=General Multimodal LLM, Parameters=3B2025.12 | 21.2 | |
| ThinkOmniBase Model=Qwen2.5-Omni-3B, LRM Guide=DeepSeek2026.02 | 20.2 | |
| Intern2.5-VL-8BModel Category=General Multimodal LLM, Parameters=8B2025.12 | 19.7 | |
| Llava-OV-7BModel Category=General Multimodal LLM, Parameters=7B2025.12 | 18.5 | |
| Qwen2.5-Omni-3B2026.02 | 18.2 | |
| Intern2-VL-8BModel Category=General Multimodal LLM, Parameters=8B2025.12 | 17.4 | |
| Qwen2-VL-7BModel Category=General Multimodal LLM, Parameters=7B2025.12 | 16.3 |