ResearchBenchmarksOffline Reinforcement Learning on HalfCheetah randomFollow33.8Normalized ScoreAnti-exploration Method-1.3527.77416.926.026Dec 2, 2025Dec 13, 2025Dec 24, 2025Jan 5, 2026Jan 16, 2026Jan 27, 2026Feb 8, 2026Evaluation ResultsMethodMethodLinksNormalized ScoreAnti-exploration Method2026.0233.8GPC-SAC2026.0231SAC-RND2026.0229DMG2026.0228.8TD3-CVAE2026.0228.6CQL2026.0228.3IQL2026.0211BOSA2025.122.2DVDF-OTDF2025.122.2DARA2025.122OTDF2025.122IQL2025.120IGDF2025.120DVDF-IGDF2025.120