Offline Inverse Reinforcement Learning on MuJoCo Hopper Medium
3,512.09Average RewardExpert Performance
Evaluation Results
| Method | Links | |
|---|---|---|
| Expert Performanceexpert demonstrations=50002023.02 | 3,512.09 | |
| ValueDICEexpert demonstrations=50002023.02 | 3,073.16 | |
| CLAREexpert demonstrations=50002023.02 | 3,015.37 | |
| BCexpert demonstrations=50002023.02 | 2,801.19 | |
| Offline ML-IRLexpert demonstrations=50002023.02 | 2,453.25 |