Reinforcement Learning on Hopper (Average Episode Reward)
2,743.9Avg Episode RewardTD3
Evaluation Results
| Method | Links | |
|---|---|---|
| TD32023.11 | 2,743.9 | |
| SAC2023.11 | 2,613.16 | |
| TRPO2023.11 | 2,593.56 | |
| PPO2023.11 | 2,586.56 | |
| ACKTR2023.11 | 2,583.88 | |
| ESPL2023.11 | 2,442.48 | |
| DSP2023.11 | 2,122.4 | |
| A2C2023.11 | 2,104.98 | |
| DDPG2023.11 | 1,678.84 | |
| SMACbatch size=1000, seeds=52026.01 | 331.2 | |
| AC-KFACbatch size=1000, seeds=52026.01 | 305 | |
| AC-Adambatch size=1000, seeds=52026.01 | 303.8 | |
| AC-SGDbatch size=1000, seeds=52026.01 | 180.5 | |
| AC-CGbatch size=1000, seeds=52026.01 | 172.7 | |
| Regression2023.11 | 47.35 |