ResearchBenchmarksOffline Reinforcement Learning on D4RL walker-medium-replay v2 (test)Follow82.3Normalized RewardVDT-2.5192819.5011141.521563.54189Jan 22, 2026Evaluation ResultsMethodMethodLinksNormalized RewardVDT2026.0182.3TD3+BC2026.0181.8DDT2026.0177.6LSDT2026.0174.7IQL2026.0173.9DT2026.0166.9CQL2026.0126.7BRAC-v2026.010.9TD3+BC2026.010.837VDT2026.010.816BRAC-v2026.010.811LSDT2026.010.81CQL2026.010.792DDT2026.010.786IQL2026.010.783DT2026.010.743