ResearchBenchmarksMulti-Agent Reinforcement Learning on sce1m (test)Follow100Win RateMAPPO87.10490.45293.897.148Jun 29, 2026Evaluation ResultsMethodMethodLinksWin RateFinal ScoreMAPPO2026.0610037.406IQL2026.0610026.666VDN2026.0699.729.794QTRAN2026.0699.427.993HRL-IM/CBS2026.0698.525.697QMIX2026.0698.525.797COMA2026.0687.619.137