ResearchDatasetsSimple_ReferenceFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsMulti-agent reinforcement learningSimple_Reference Heavy DBC62.1Avg Episode Cumulative Reward7