ResearchBenchmarksMulti-agent Offline Reinforcement Learning on MPE PP (Expert)Follow125.6ScoreDoF92.632101.191109.75118.309Sep 22, 2023Feb 22, 2024Jul 24, 2024Dec 25, 2024May 27, 2025Oct 27, 2025Mar 30, 2026Evaluation ResultsMethodMethodLinksScoreDoF2026.03125.6CFCQL2023.09118.2CFCQL2026.03118.2OMAR2023.09116.2OMAR2026.03116.2MATD3-BC2023.09115.2MA-TD3+BC2026.03115.2MAICQ2023.09113SPaCQL2026.03111.2IQL2023.09109.3IQL2026.03109.3MACQL2023.09108.4MACQL2026.03108.4PLCQL2026.03107.1AWAC2023.09106.5ICQL2023.0993.9