Reinforcement Learning on MuJoCo Swimmer v4
271Normalized PerformanceAD-SAC
Evaluation Results
| Method | Links | |
|---|---|---|
| AD-SACDelays=50, Global steps=1M2024.05 | 271 | |
| AD-SACDelays=25, Global steps=1M2024.05 | 252 | |
| VDPODelays=50, Global steps=1M2024.05 | 242 | |
| VDPODelays=25, Global steps=1M2024.05 | 235 | |
| VDPODelays=5, Global steps=1M2024.05 | 230 | |
| BPQLDelays=50, Global steps=1M2024.05 | 223 | |
| AD-SACDelays=5, Global steps=1M2024.05 | 182 | |
| BPQLDelays=25, Global steps=1M2024.05 | 136 | |
| DC/ACDelays=5, Global steps=1M2024.05 | 111 | |
| DIDADelays=5, Global steps=1M2024.05 | 105 | |
| BPQLDelays=5, Global steps=1M2024.05 | 97 | |
| DIDADelays=25, Global steps=1M2024.05 | 93 | |
| A-SACDelays=5, Global steps=1M2024.05 | 88 | |
| DIDADelays=50, Global steps=1M2024.05 | 87 | |
| DC/ACDelays=25, Global steps=1M2024.05 | 78 | |
| A-SACDelays=25, Global steps=1M2024.05 | 72 | |
| A-SACDelays=50, Global steps=1M2024.05 | 69 | |
| DC/ACDelays=50, Global steps=1M2024.05 | 68 |