ResearchDatasetssce1mFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsMulti-Agent Reinforcement Learningsce1m (test)100Win Rate7