Large Vision-Language Model Evaluation
Benchmarks
Dataset NameSOTA methodMetricTrendResultsLast Updated
9.8ECE
29
May 12, 2026
68.5MMBench
16
Feb 26, 2026
29.68MCQ Score
14
Mar 10, 2026
47.22MCQ Accuracy
14
Mar 10, 2026
27.04MCQ Score
14
Mar 10, 2026
72.5Overall Score
13
Feb 26, 2026
1,711.44Perception Score
12
Apr 15, 2026
77.6Score
11
Feb 26, 2026
77.8Score
10
Feb 26, 2026