Reinforcement Learning on neorl walker2d-medium
70.1Normalized ScoreADMPO-OFF
Evaluation Results
| Method | Links | |
|---|---|---|
| ADMPO-OFFLearning Mode=Offline, Seeds=52024.05 | 70.1 | |
| MOBILELearning Mode=Offline, Seeds=52024.05 | 62.2 | |
| TD3+BCLearning Mode=Offline, Seeds=52024.05 | 58.5 | |
| EDACLearning Mode=Offline, Seeds=52024.05 | 57.6 | |
| CQLLearning Mode=Offline, Seeds=52024.05 | 57.3 | |
| BCLearning Mode=Offline, Seeds=52024.05 | 48.7 | |
| MOPOLearning Mode=Offline, Seeds=52024.05 | 39.9 |