Offline Reinforcement Learning on Hopper kinematic shifts
97ScoreOTDF
Evaluation Results
| Method | Links | |
|---|---|---|
| OTDFSource Policy=expert, Target Policy=expert2025.12 | 97 | |
| DROCOSource Policy=expert, Target Policy=expert2025.12 | 89.3 | |
| DROCOSource Policy=medium, Target Policy=expert2025.12 | 80.8 | |
| IGDFSource Policy=expert, Target Policy=expert2025.12 | 70.1 | |
| OTDFSource Policy=medium, Target Policy=expert2025.12 | 69.3 | |
| IQLSource Policy=expert, Target Policy=expert2025.12 | 62.6 | |
| DROCOSource Policy=expert, Target Policy=medium2025.12 | 62.2 | |
| IGDFSource Policy=medium, Target Policy=expert2025.12 | 61.8 | |
| IGDFSource Policy=expert, Target Policy=medium2025.12 | 61.3 | |
| IQLSource Policy=medium, Target Policy=expert2025.12 | 56.1 | |
| DROCOSource Policy=medium, Target Policy=medium2025.12 | 55.4 | |
| IGDFSource Policy=medium, Target Policy=medium2025.12 | 54.3 | |
| IQLSource Policy=expert, Target Policy=medium2025.12 | 53.6 | |
| OTDFSource Policy=expert, Target Policy=medium2025.12 | 51.4 | |
| IQLSource Policy=medium, Target Policy=medium2025.12 | 48.8 | |
| OTDFSource Policy=medium, Target Policy=medium2025.12 | 46.3 |