ResearchBenchmarksCooperative Multi-Agent Reinforcement Learning on MPE simple_spreadFollow91.24RewardCOMA-47.5792-11.539624.560.5396Jun 9, 2026Evaluation ResultsMethodMethodLinksRewardCumulative RegretRegret GapCOMA2026.0691.2443.7239.93QMIX2026.0688.49390.13248.44MAPPO2026.0655.68988527.92MADDPG2026.0653.552,177.97165.32Φ-AC2026.06-42.24460.46260.64