Reinforcement Learning on neorl hopper-low
22.3Normalized ScoreADMPO-OFF
Evaluation Results
| Method | Links | |
|---|---|---|
| ADMPO-OFFLearning Mode=Offline, Seeds=52024.05 | 22.3 | |
| EDACLearning Mode=Offline, Seeds=52024.05 | 18.3 | |
| MOBILELearning Mode=Offline, Seeds=52024.05 | 17.4 | |
| CQLLearning Mode=Offline, Seeds=52024.05 | 16 | |
| TD3+BCLearning Mode=Offline, Seeds=52024.05 | 15.8 | |
| BCLearning Mode=Offline, Seeds=52024.05 | 15.1 | |
| MOPOLearning Mode=Offline, Seeds=52024.05 | 6.2 |