ResearchBenchmarksMulti-agent Offline Reinforcement Learning on MPE PP (Random)Follow92.8ScorePLCQL-3.50421.49846.571.502Sep 22, 2023Feb 22, 2024Jul 24, 2024Dec 25, 2024May 27, 2025Oct 27, 2025Mar 30, 2026Evaluation ResultsMethodMethodLinksScorePLCQL2026.0392.8SPaCQL2026.0389.4CFCQL2023.0978.5CFCQL2026.0378.5MACQL2023.0925.2MACQL2026.0325.2DoF2026.0316.5OMAR2023.0911.1OMAR2026.0311.1MATD3-BC2023.095.7MA-TD3+BC2026.035.7ICQL2023.095MAICQ2023.092.2IQL2023.091.3IQL2026.031.3AWAC2023.090.2