ResearchTasksPluralistic Reward Model LearningFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedARENAPAL60.56Accuracy (ARENA)10Mar 31, 2026PRISMEpiPersona59.6Accuracy10Mar 31, 2026