STEM & Reasoning on MMMU-Pro
81AccuracyGemini 3-Pro
Evaluation Results
| Method | Links | |
|---|---|---|
| Gemini 3-Pro2026.02 | 81 | |
| GPT-5tier=High2026.02 | 78.4 | |
| Gemini 2.5-Pro2026.02 | 68.8 | |
| ERNIE 5.02026.02 | 68.63 | |
| Qwen3-VLmode=Thinking2026.02 | 68.28 | |
| Qwen3-VL-8BFine-tuning setting=Base2026.07 | 56.71 | |
| Qwen3-VL-8BFine-tuning setting=CPO2026.07 | 53.7 | |
| Qwen3-VL-8BFine-tuning setting=LoRA2026.07 | 41.98 | |
| Qwen3-VL-8BFine-tuning setting=GRPO2026.07 | 40.56 | |
| Qwen3-VL-8BFine-tuning setting=GSPO2026.07 | 31.41 | |
| InternVL2-Pt + IRABackbone=InternVL2, Training stage=IRA2026.07 | 31.2 | |
| InternVL2.5-Pt + IRABackbone=InternVL2.5, Training stage=IRA2026.07 | 30.6 | |
| InternVL2.5-Pt + SFTBackbone=InternVL2.5, Training stage=SFT2026.07 | 30.4 | |
| InternVL2-Pt + SFTBackbone=InternVL2, Training stage=SFT2026.07 | 30.1 | |
| LLaVA-OV-Pt + IRABackbone=LLaVA-OV, Training stage=IRA2026.07 | 28 | |
| LLaVA-OV-Pt + SFTBackbone=LLaVA-OV, Training stage=SFT2026.07 | 27.4 | |
| InternVL2.5-PtBackbone=InternVL2.5, Training stage=Pre-trained2026.07 | 26.7 | |
| InternVL2-PtBackbone=InternVL2, Training stage=Pre-trained2026.07 | 26 | |
| Qwen3-VL-8BFine-tuning setting=FFT2026.07 | 24.91 | |
| LLaVA-OV-PtBackbone=LLaVA-OV, Training stage=Pre-trained2026.07 | 20.5 |