ResearchBenchmarksMulti-agent Offline Reinforcement Learning on MPE PP (Medium-replay)Follow87.3ScorePLCQL5.1426.4747.869.13Sep 22, 2023Feb 22, 2024Jul 24, 2024Dec 25, 2024May 27, 2025Oct 27, 2025Mar 30, 2026Evaluation ResultsMethodMethodLinksScorePLCQL2026.0387.3SPaCQL2026.0375CFCQL2023.0971.1CFCQL2026.0371.1DoF2026.0365.4OMAR2023.0947.1OMAR2026.0347.1MAICQ2023.0934.5MATD3-BC2023.0928.7MA-TD3+BC2026.0328.7ICQL2023.0924.8IQL2023.0923.2IQL2026.0323.2MACQL2023.0911.9MACQL2026.0311.9AWAC2023.098.3