Offline Reinforcement Learning on D4RL Walker2d Med-Replay
82.6Normalized Average ReturnTT
Evaluation Results
| Method | Links | |
|---|---|---|
| TT2023.10 | 82.6 | |
| TT2025.09 | 82.6 | |
| RGGplanning seeds=152023.10 | 78.3 | |
| RGG+planning seeds=152023.10 | 77.5 | |
| CQL2023.10 | 77.2 | |
| CQL2025.09 | 77.2 | |
| WFDiffuser2025.09 | 76.3 | |
| Decision Diffuser2025.09 | 75 | |
| IQL2023.10 | 73.9 | |
| IQL2025.09 | 73.9 | |
| DT2023.10 | 66.6 | |
| DT2025.09 | 66.6 | |
| Diffuser2023.10 | 61.2 | |
| MOREL2023.10 | 49.8 | |
| MOReL2025.09 | 49.8 | |
| MOPO2023.10 | 39 | |
| BC2023.10 | 26 | |
| BC2025.09 | 26 | |
| MBOP2023.10 | 9.7 |