ResearchDatasetsVL-RewardFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsMulti-modal Preference EvaluationVL-Reward79.6Accuracy19