ResearchDatasetsBESPOKE-MetaFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsPersonalized Reward ModelingBESPOKE-Meta OOD75.48Binary Preference Accuracy18