Offline Reinforcement Learning on D4RL Walker2d-M
85Normalized ReturnDAWM-IQL
Evaluation Results
| Method | Links | |
|---|---|---|
| DAWM-IQLModel Framework=DAWM, RL Algorithm=IQL2025.09 | 85 | |
| SSORL-IQLAgent=IQL, Training Strategy=SSORL-augmented2025.09 | 85 | |
| DAWM-IQLAgent=IQL, Training Strategy=DAWM-synthetic2025.09 | 85 | |
| SSORL-TD3BCAgent=TD3BC, Training Strategy=SSORL-augmented2025.09 | 81 | |
| DAWM-TD3BCModel Framework=DAWM, RL Algorithm=TD3BC2025.09 | 79 | |
| DAWM-TD3BCAgent=TD3BC, Training Strategy=DAWM-synthetic2025.09 | 79 | |
| IQLAgent=IQL, Training Strategy=Standard (Real Data)2025.09 | 79 | |
| TD3BCAgent=TD3BC, Training Strategy=Standard (Real Data)2025.09 | 77 | |
| DWM-IQLModel Framework=DWM, RL Algorithm=IQL2025.09 | 76 | |
| DWM-TD3BCModel Framework=DWM, RL Algorithm=TD3BC2025.09 | 70 | |
| DDModel Framework=DD2025.09 | 67 |