Offline Reinforcement Learning on D4RL Walker2d-ME
1.11Normalized ReturnSSORL-TD3BC
Evaluation Results
| Method | Links | |
|---|---|---|
| SSORL-TD3BCAgent=TD3BC, Training Strategy=SSORL-augmented2025.09 | 1.11 | |
| SSORL-IQLAgent=IQL, Training Strategy=SSORL-augmented2025.09 | 1.11 | |
| DWM-TD3BCModel Framework=DWM, RL Algorithm=TD3BC2025.09 | 1.1 | |
| DAWM-TD3BCModel Framework=DAWM, RL Algorithm=TD3BC2025.09 | 1.1 | |
| DAWM-IQLModel Framework=DAWM, RL Algorithm=IQL2025.09 | 1.1 | |
| DAWM-TD3BCAgent=TD3BC, Training Strategy=DAWM-synthetic2025.09 | 1.1 | |
| DAWM-IQLAgent=IQL, Training Strategy=DAWM-synthetic2025.09 | 1.1 | |
| TD3BCAgent=TD3BC, Training Strategy=Standard (Real Data)2025.09 | 1.08 | |
| IQLAgent=IQL, Training Strategy=Standard (Real Data)2025.09 | 1.08 | |
| DWM-IQLModel Framework=DWM, RL Algorithm=IQL2025.09 | 1.04 | |
| DDModel Framework=DD2025.09 | 0.99 |