ResearchBenchmarksOffline Goal-Conditioned Reinforcement Learning on cube-triple 100MFollow98Success RateDQC16.8837.945980.06Dec 11, 2025Evaluation ResultsMethodMethodLinksSuccess RateDQCMethod=Decoupled Q-chu...Method=Decoupled Q-chunking2025.1298NSBackup=n-step return b...Backup=n-step return backup2025.1293SHARSA2025.1283IQL2025.1266HFBC2025.1256FBC2025.1254OSBackup=1-step TD-backupBackup=1-step TD-backup2025.1247HIQL2025.1235DQC-naïveExecution=partial acti...Execution=partial action chunk2025.1227QCStrategy=Q-chunkingStrategy=Q-chunking2025.1220