ResearchDatasetsCaveflyerFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningCaveflyer (test)11.14Avg Cumulative Reward5