ResearchDatasetsPersonalRewardBenchFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsPersonalized LLM Alignment EvaluationPersonalRewardBench (test)3.354Mean Score6Reward ModelingPersonalRewardBench (test)65.21Macro Accuracy6