ResearchDatasetsJumperFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsReinforcement LearningJumper (test)9.76Avg Cumulative Reward5