ResearchBenchmarksOffline Reinforcement Learning on D4RL Maze maze2d-large v2 (test)Follow156.4Normalized ScoreA2PO-6.77635.58777.95120.313Mar 12, 2024Evaluation ResultsMethodMethodLinksNormalized ScoreA2PO2024.03156.4TD3+BC2024.03128.5Diffusion-QL2024.03116.3LAPO2024.0369.7EQL2024.0357IQL2024.0345.7AWAC2024.0343.9BCQ2024.0343CQL2024.0312.5CQL+AW2024.0310.3BC2024.031.1MOPO2024.03-0.5