ResearchBenchmarksOffline Reinforcement Learning on D4RL hopper-medium v2 (test)Follow99.4Normalized RewardDDT28.36846.80965.2583.691Jan 22, 2026Evaluation ResultsMethodMethodLinksNormalized RewardDDT2026.0199.4VDT2026.0198.3LSDT2026.0187.2DT2026.0168.3IQL2026.0166.3TD3+BC2026.0159.3CQL2026.0158BRAC-v2026.0131.1