Offline Inverse Reinforcement Learning on MuJoCo halfcheetah (medium)
12,174.61Average RewardExpert Performance
Evaluation Results
| Method | Links | |
|---|---|---|
| Expert Performanceexpert demonstrations=50002023.02 | 12,174.61 | |
| Offline ML-IRLexpert demonstrations=50002023.02 | 7,640.73 | |
| BCexpert demonstrations=50002023.02 | 4,471.72 | |
| ValueDICEexpert demonstrations=50002023.02 | 1,125.17 | |
| CLAREexpert demonstrations=50002023.02 | 841.46 |