ResearchBenchmarksMulti-agent Offline Reinforcement Learning on MPE World ExpertFollow135.2ScoreDoF69.36886.459103.55120.641Sep 22, 2023Feb 22, 2024Jul 24, 2024Dec 25, 2024May 27, 2025Oct 27, 2025Mar 30, 2026Evaluation ResultsMethodMethodLinksScoreDoF2026.03135.2PLCQL2026.03133CFCQL2023.09119.7CFCQL2026.03119.7SPaCQL2026.03112.3OMAR2023.09110.4OMAR2026.03110.4MATD3-BC2023.09110.3MA-TD3+BC2026.03110.3MAICQ2023.09109.5IQL2023.09107.8IQL2026.03107.8AWAC2023.09107.6MACQL2023.0999.7MACQL2026.0399.7ICQL2023.0971.9