Visual Reasoning on MMMU (val)
64.8AccuracyInsight-V++
Evaluation Results
| Method | Links | |
|---|---|---|
| Insight-V++Size=7B, Base Model=Qwen2.5-VL, Self-Evolving=true2026.03 | 64.8 | |
| Qwen2.5-VL + Multi-Agent (RL)Size=7B, Multi-Agent (RL)=true2026.03 | 62.5 | |
| Qwen2.5-VLSize=7B2026.03 | 58.6 | |
| Qwen2-VLSize=7B2026.03 | 53.7 | |
| POINTSSize=7B2026.03 | 51.4 | |
| Insight-VSize=7B, Base Model=Our Base Model, Iterative DPO=true2026.03 | 50.2 | |
| MiniCPM-V-2.6Size=7B2026.03 | 49.8 | |
| Our Base Model + Multi-AgentSize=7B, Multi-Agent=true2026.03 | 49.7 | |
| Ovis1.5-LLaMA3Size=8B2026.03 | 48.3 | |
| Our Base ModelSize=7B2026.03 | 47.1 | |
| Idefics3-LLaMA3Size=8B2026.03 | 46.6 | |
| MiniCPM-LLaMA3-V 2.5Size=8B2026.03 | 45.8 | |
| Bunny-LLaMA3Size=8B2026.03 | 43.4 | |
| IXC-2.5Size=7B2026.03 | 42.9 | |
| Cambrian-1Size=8B2026.03 | 42.7 | |
| Insight-V-LLaVASize=8B, Base Model=LLaVA-NeXT-LLaMA3, Iterative DPO=true2026.03 | 42 | |
| MM-1.5Size=7B2026.03 | 41.8 | |
| InternLM-XComposer2Size=7B2026.03 | 41.1 | |
| LLaVA-NeXT-LLaMA3 + Multi-AgentSize=8B, Multi-Agent=true2026.03 | 40.8 | |
| VILA-1.5Size=8B2026.03 | 38.6 | |
| LLaVA-NeXT-LLaMA3Size=8B2026.03 | 36.9 | |
| DeepSeek-VLSize=7B2026.03 | 35.4 |