ResearchBenchmarksMulti-agent Offline Reinforcement Learning on MPE CN (Random)Follow88.3ScorePLCQL-3.01220.69444.468.106Sep 22, 2023Feb 22, 2024Jul 24, 2024Dec 25, 2024May 27, 2025Oct 27, 2025Mar 30, 2026Evaluation ResultsMethodMethodLinksScorePLCQL2026.0388.3SPaCQL2026.0378.2CFCQL2023.0962.2CFCQL2026.0362.2MACQL2023.0945.6MACQL2026.0345.6DoF2026.0335.9OMAR2023.0934.4OMAR2026.0334.4ICQL2023.0924MATD3-BC2023.099.8MA-TD3+BC2026.039.8MAICQ2023.096.3IQL2023.095.5IQL2026.035.5AWAC2023.090.5