ResearchBenchmarksMulti-agent Reinforcement Learning on SMAC 2s3zFollow100Win RatePCMA32.449.9567.585.05Apr 10, 2026Apr 20, 2026May 1, 2026May 11, 2026May 22, 2026Jun 1, 2026Jun 12, 2026Evaluation ResultsMethodMethodLinksWin RateAverage RewardPCMA2026.061000.31MAPPO2026.06970.3IPPO2026.06930.29SeqComm-DFLTraining Iterations=10MTraining Iterations=10M2026.0464—MADDPG2026.06630.22SeqCommTraining Iterations=10MTraining Iterations=10M2026.0449—OMDTraining Iterations=10MTraining Iterations=10M2026.0435—