ResearchDatasetsDelayed MuJoCo AntFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningDelayed MuJoCo Ant v2 (test)4,851.64Max Average Return6