ResearchBenchmarksOffline Reinforcement Learning on D4RL Adroit pen-human v1 (test)Follow72.8Normalized ScoreDiffusion-QL-6.7613.89534.5555.205Mar 12, 2024Evaluation ResultsMethodMethodLinksNormalized ScoreDiffusion-QL2024.0372.8IQL2024.0371.5A2PO2024.0368.9LAPO2024.0368.1MOPO2024.0354.6EQL2024.0344.3CQL2024.0337.5BC2024.0334.4BCQ2024.0312.3AWAC2024.034.3CQL+AW2024.03-3TD3+BC2024.03-3.7