ResearchDatasetsTwo dim reward functionFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsRegret MinimizationTwo dim reward function synthetic (test)2,589.32Oracle Regret9Regret MinimizationTwo dim reward function weak adversaries Appendix A.7 (test)2,589.32Oracle Regret9
Regret MinimizationTwo dim reward function weak adversaries Appendix A.7 (test)2,589.32Oracle Regret9