Offline Reinforcement Learning on D4RL Gym halfcheetah-random
35.4Normalized ScoreCQL-Min
Evaluation Results
| Method | Links | |
|---|---|---|
| CQL-Min2024.01 | 35.4 | |
| SPQRBase algorithm=SAC-Min2024.01 | 33.5 | |
| DOSER2026.05 | 32.8 | |
| CQL2022.06 | 31.3 | |
| SAC-10Implementation Source=Reproduced, Ensemble Size=102022.06 | 29 | |
| DMG2026.05 | 28.8 | |
| RORLImplementation Source=Ours, Ensemble Size=102022.06 | 28.5 | |
| EDACImplementation Source=Paper2022.06 | 28.4 | |
| EDAC2024.01 | 28.4 | |
| SAC-Min2024.01 | 28 | |
| CQL2026.05 | 17.5 | |
| EDAC-10Implementation Source=Reproduced, Ensemble Size=102022.06 | 13.4 | |
| IQL2026.05 | 13.1 | |
| PBRL2022.06 | 11 | |
| TD3+BC2026.05 | 11 | |
| AWAC2026.05 | 6.1 | |
| BC2026.05 | 2.6 | |
| BEAR2026.05 | 2.3 | |
| OneStep2026.05 | 2.3 | |
| BC2022.06 | 2.2 | |
| BC2024.01 | 2.2 | |
| BCQ2026.05 | 2.2 | |
| DT2026.05 | 2.2 |