ResearchDatasetsCheetah-Dir-EFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningCheetah-Dir-E reward changes, episodic972.4Average Return8