ResearchDatasetsKeyCorridorFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningKeyCorridor S3R1 (train)0.902Mean Episodic Return5