Offline Reinforcement Learning on D4RL Hopper-ME
1.1Normalized ReturnSSORL-IQL
Evaluation Results
| Method | Links | |
|---|---|---|
| SSORL-IQLAgent=IQL, Training Strategy=SSORL-augmented2025.09 | 1.1 | |
| DAWM-TD3BCModel Framework=DAWM, RL Algorithm=TD3BC2025.09 | 1.08 | |
| DAWM-TD3BCAgent=TD3BC, Training Strategy=DAWM-synthetic2025.09 | 1.08 | |
| DDModel Framework=DD2025.09 | 1.06 | |
| DWM-TD3BCModel Framework=DWM, RL Algorithm=TD3BC2025.09 | 1.03 | |
| SSORL-TD3BCAgent=TD3BC, Training Strategy=SSORL-augmented2025.09 | 0.96 | |
| TD3BCAgent=TD3BC, Training Strategy=Standard (Real Data)2025.09 | 0.9 | |
| DAWM-IQLModel Framework=DAWM, RL Algorithm=IQL2025.09 | 0.88 | |
| DAWM-IQLAgent=IQL, Training Strategy=DAWM-synthetic2025.09 | 0.88 | |
| DWM-IQLModel Framework=DWM, RL Algorithm=IQL2025.09 | 0.82 | |
| IQLAgent=IQL, Training Strategy=Standard (Real Data)2025.09 | 0.77 |