Visual Question Answering on VQA v2.0 47 (val)
87AccuracyMolmo2-8B
Evaluation Results
| Method | Links | |
|---|---|---|
| Molmo2-8BModel Category=Molmo2 family2026.01 | 87 | |
| Molmo2-4BModel Category=Molmo2 family2026.01 | 86.6 | |
| Molmo2-O-7BModel Category=Molmo2 family2026.01 | 86.6 | |
| Molmo-72BModel Category=Molmo1 family2026.01 | 86.5 | |
| PLM-8BModel Category=Open models2026.01 | 85.6 | |
| Molmo-7B-DModel Category=Molmo1 family2026.01 | 85.6 | |
| Molmo-7B-OModel Category=Molmo1 family2026.01 | 85.3 | |
| PLM-3BModel Category=Open models2026.01 | 84.4 | |
| MolmoE-1BModel Category=Molmo1 family2026.01 | 83.9 | |
| Eagle2.5-8BModel Category=Open weights only2026.01 | 82.4 | |
| Qwen3-VL-8BModel Category=Open weights only2026.01 | 82.3 | |
| Qwen3-VL-4BModel Category=Open weights only2026.01 | 81.7 | |
| GPT-5Model Category=API call only2026.01 | 79.7 | |
| InternVL3.5-8BModel Category=Open weights only2026.01 | 79.5 | |
| Keye-VL-1.5-8BModel Category=Open weights only2026.01 | 79.3 | |
| InternVL3.5-4BModel Category=Open weights only2026.01 | 78.1 | |
| Claude Sonnet 4.5Model Category=API call only2026.01 | 77 | |
| Gemini 3 ProModel Category=API call only2026.01 | 74.1 | |
| GPT-5 miniModel Category=API call only2026.01 | 72.1 | |
| Gemini 2.5 FlashModel Category=API call only2026.01 | 69.4 | |
| GLM-4.1V-9BModel Category=Open weights only2026.01 | 68.3 | |
| Gemini 2.5 ProModel Category=API call only2026.01 | 67.1 | |
| MiniCPM-V-4.5-8BModel Category=Open weights only2026.01 | 64.1 |