Reinforcement Learning on neorl hopper high
87.8Normalized ScoreMOBILE
Evaluation Results
| Method | Links | |
|---|---|---|
| MOBILELearning Mode=Offline, Seeds=52024.05 | 87.8 | |
| ADMPO-OFFLearning Mode=Offline, Seeds=52024.05 | 87.6 | |
| CQLLearning Mode=Offline, Seeds=52024.05 | 76.6 | |
| TD3+BCLearning Mode=Offline, Seeds=52024.05 | 75.3 | |
| EDACLearning Mode=Offline, Seeds=52024.05 | 52.5 | |
| BCLearning Mode=Offline, Seeds=52024.05 | 43.1 | |
| MOPOLearning Mode=Offline, Seeds=52024.05 | 11.5 |