ResearchBenchmarksOffline Reinforcement Learning on D4RL Adroit pen-cloned v1 (test)Follow85Normalized ScoreA2PO-617.62541.2564.875Mar 12, 2024Evaluation ResultsMethodMethodLinksNormalized ScoreA2PO2024.0385Diffusion-QL2024.0357.3BC2024.0356.9LAPO2024.0355.8EQL2024.0346.9CQL2024.0339.2IQL2024.0337.3BCQ2024.0328MOPO2024.0310.7TD3+BC2024.031.7AWAC2024.03-0.8CQL+AW2024.03-2.5