ResearchDatasetsF_LRFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsRegret MinimizationF_LR Stochastic Low-Rank Reward2Regret4