ResearchTasksFederated Value Alignment (Direct Preference Optimization)FollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedHH-RLHF (test)FedACT0.687Loss8Jul 7, 2026