Offline Reinforcement Learning on HalfCheetah kinematic shifts
79.6ScoreOTDF
Evaluation Results
| Method | Links | |
|---|---|---|
| OTDFSource Policy=expert, Target Policy=expert2025.12 | 79.6 | |
| DROCOSource Policy=expert, Target Policy=expert2025.12 | 67.4 | |
| DROCOSource Policy=expert, Target Policy=medium2025.12 | 58.5 | |
| OTDFSource Policy=medium, Target Policy=expert2025.12 | 58.3 | |
| DROCOSource Policy=medium, Target Policy=expert2025.12 | 52.6 | |
| OTDFSource Policy=expert, Target Policy=medium2025.12 | 51.7 | |
| IQLSource Policy=expert, Target Policy=expert2025.12 | 49.7 | |
| IGDFSource Policy=expert, Target Policy=expert2025.12 | 47.6 | |
| IQLSource Policy=medium, Target Policy=expert2025.12 | 47.5 | |
| IQLSource Policy=expert, Target Policy=medium2025.12 | 47.1 | |
| IGDFSource Policy=expert, Target Policy=medium2025.12 | 46.8 | |
| IGDFSource Policy=medium, Target Policy=expert2025.12 | 45.4 | |
| DROCOSource Policy=medium, Target Policy=medium2025.12 | 45.3 | |
| IQLSource Policy=medium, Target Policy=medium2025.12 | 45.2 | |
| IGDFSource Policy=medium, Target Policy=medium2025.12 | 45.2 | |
| OTDFSource Policy=medium, Target Policy=medium2025.12 | 42.2 |