Offline Reinforcement Learning on D4RL Walker2d-MR
92Normalized ReturnSSORL-IQL
Evaluation Results
| Method | Links | |
|---|---|---|
| SSORL-IQLAgent=IQL, Training Strategy=SSORL-augmented2025.09 | 92 | |
| TD3BCAgent=TD3BC, Training Strategy=Standard (Real Data)2025.09 | 75 | |
| SSORL-TD3BCAgent=TD3BC, Training Strategy=SSORL-augmented2025.09 | 73 | |
| IQLAgent=IQL, Training Strategy=Standard (Real Data)2025.09 | 68 | |
| DAWM-TD3BCModel Framework=DAWM, RL Algorithm=TD3BC2025.09 | 61 | |
| DAWM-TD3BCAgent=TD3BC, Training Strategy=DAWM-synthetic2025.09 | 61 | |
| DAWM-IQLModel Framework=DAWM, RL Algorithm=IQL2025.09 | 54 | |
| DAWM-IQLAgent=IQL, Training Strategy=DAWM-synthetic2025.09 | 54 | |
| DWM-TD3BCModel Framework=DWM, RL Algorithm=TD3BC2025.09 | 46 | |
| DDModel Framework=DD2025.09 | 44 | |
| DWM-IQLModel Framework=DWM, RL Algorithm=IQL2025.09 | 35 |