ResearchBenchmarksMulti-Agent Reinforcement Learning on MPE World Medium ReplayFollow65.9Mean Episode ReturnDOM22.14818.69935.2551.801Jul 4, 2023Evaluation ResultsMethodMethodLinksMean Episode ReturnDOM22023.0765.9DOM22023.0751.5OMAR2023.0721.1OMAR2023.0720.1MA-CQL2023.0715.9MA-SfBC2023.079.1MA-CQL2023.078.1MA-SfBC2023.074.6