ResearchBenchmarksOffline Reinforcement Learning on D4RL Maze maze2d-medium v2 (test)Follow11,490Normalized ScoreA2PO-386.82,696.65,7808,863.4Mar 12, 2024Evaluation ResultsMethodMethodLinksNormalized ScoreA2PO2024.0311,490Diffusion-QL2024.0310,060LAPO2024.034,320EQL2024.033,630TD3+BC2024.033,350AWAC2024.033,140IQL2024.032,570CQL+AW2024.032,260BCQ2024.032,250MOPO2024.031,900CQL2024.03500BC2024.0370