ResearchBenchmarksMulti-Agent Reinforcement Learning on sce2m (train)Follow100Win RateMAPPO98.23298.69199.1599.609Jun 29, 2026Evaluation ResultsMethodMethodLinksWin RateFinal ScoreMAPPO2026.0610061.892HRL-IM/CBS2026.0699.751.773COMA2026.0699.540.988IQL2026.0699.442.589VDN2026.0699.332.062QTRAN2026.0699.238.835QMIX2026.0698.333.401