ResearchTasksMultilingual Reward ModelingFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedMM-Eval Avg. 18 langDIBJudge-Qwen3-8B87.53Accuracy14Mar 12, 2026m-RewardBench Avg. 23 langsDIBJudge-Qwen3-8B91.37Accuracy14Mar 12, 2026