ResearchDatasetsobstacle4FollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement Learningobstacle4 non-convex33.4Return5