ResearchDatasetsVLRewardBenchFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReward ModelingVLRewardBench (test)84.7General39Vision-Language Reward Model EvaluationVLRewardBench74.5Accuracy8