ResearchDatasetsSimple ReferenceFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsMulti-agent reinforcement learningSimple Reference Unrestricted76.9Avg Episode Cumulative Reward7