ResearchBenchmarksOffline Reinforcement Learning on Walker2d randomFollow21.5Normalized ScoreSAC-RND-0.864.94510.7516.555Dec 2, 2025Dec 13, 2025Dec 24, 2025Jan 5, 2026Jan 16, 2026Jan 27, 2026Feb 8, 2026Evaluation ResultsMethodMethodLinksNormalized ScoreSAC-RND2026.0221.5GPC-SAC2026.029.6Anti-exploration Method2026.028.4IQL2026.026.4TD3-CVAE2026.025.5DMG2026.024.8CQL2026.024.2IQL2025.120BOSA2025.120DARA2025.120IGDF2025.120DVDF-IGDF2025.120OTDF2025.120DVDF-OTDF2025.120