ResearchBenchmarksOffline Reinforcement Learning on D4RL Adroit hammer (3 tasks: human, cloned, expert)Follow46.2Normalized ScoreMoMa QL31.1235.03538.9542.865May 27, 2026Evaluation ResultsMethodMethodLinksNormalized ScoreMoMa QL2026.0546.2FQL2026.0545.7ReBRAC2026.0545.3IQL2026.0544.3BC2026.0543.7SRPO2026.0543.3IDQL2026.0543FBRAC2026.0541IFQL2026.0540.7FAWAC2026.0540.3CAC2026.0531.7