ResearchDatasetsHH-RLHFFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsTest-time AlignmentHH-RLHF86Win Rate vs Llama3Conversational AssistantHH-RLHF0.5Reward3Alignment EvaluationHH-RLHF (test)65.4Reward Model Score2Preference PredictionHH-RLHF9Count of Significant Features (S)2Page 3 of 3PreviousNext