ResearchBenchmarksMulti-agent Offline Reinforcement Learning on MPE Cooperative Navigation (CN) v1 (Med-Rep)Follow95.4ScorePLCQL-1.00824.02149.0574.079Sep 22, 2023Feb 22, 2024Jul 24, 2024Dec 25, 2024May 27, 2025Oct 27, 2025Mar 30, 2026Evaluation ResultsMethodMethodLinksScorePLCQL2026.0395.4SPaCQL2026.0371.9DoF2026.0357.4CFCQL2023.0952.2CFCQL2026.0352.2OMAR2023.0937.9OMAR2026.0337.9MACQL2023.0925.5MACQL2026.0325.5ICQL2023.0920MATD3-BC2023.0915.4MA-TD3+BC2026.0315.4MAICQ2023.0913.6IQL2023.0910.8IQL2026.0310.8AWAC2023.092.7