ResearchDatasetsCN-qFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsMulti-Agent Reinforcement LearningCN-q rac-dist (test)144Mean Episodic Reward (q=3)12