ResearchBenchmarksOffline Reinforcement Learning on D4RL Walker-medium-expert v2Follow113Normalized ReturnOnestep72.9683.35593.75104.145Feb 13, 2022Oct 10, 2022Jun 7, 2023Feb 2, 2024Sep 29, 2024May 27, 2025Jan 22, 2026Evaluation ResultsMethodMethodLinksNormalized ReturnOnestep2022.02113SPOT2022.02112VDT2026.01110.4TD3+BC2022.02110.1TD3+BC2026.01110.1LSDT2026.01109.8IQL2022.02109.6IQL2026.01109.6DDT2026.01109.5CQL2022.02108.8DT2026.01108.6DT2022.02108.1BC2022.02107.5CQL2026.0198.7BRAC-v2026.0181.6AWAC2022.0274.5