Offline Reinforcement Learning on Walker2d kinematic shifts
106ScoreDROCO
Evaluation Results
| Method | Links | |
|---|---|---|
| DROCOSource Policy=expert, Target Policy=expert2025.12 | 106 | |
| OTDFSource Policy=expert, Target Policy=expert2025.12 | 98.9 | |
| DROCOSource Policy=medium, Target Policy=expert2025.12 | 94.6 | |
| IGDFSource Policy=expert, Target Policy=expert2025.12 | 93.7 | |
| IQLSource Policy=expert, Target Policy=expert2025.12 | 90.1 | |
| DROCOSource Policy=expert, Target Policy=medium2025.12 | 83 | |
| IGDFSource Policy=medium, Target Policy=expert2025.12 | 82.5 | |
| OTDFSource Policy=medium, Target Policy=expert2025.12 | 76.8 | |
| IQLSource Policy=medium, Target Policy=expert2025.12 | 71.4 | |
| DROCOSource Policy=medium, Target Policy=medium2025.12 | 70.8 | |
| IGDFSource Policy=expert, Target Policy=medium2025.12 | 58.6 | |
| OTDFSource Policy=expert, Target Policy=medium2025.12 | 57.9 | |
| IQLSource Policy=expert, Target Policy=medium2025.12 | 55.4 | |
| IGDFSource Policy=medium, Target Policy=medium2025.12 | 51.8 | |
| IQLSource Policy=medium, Target Policy=medium2025.12 | 48.7 | |
| OTDFSource Policy=medium, Target Policy=medium2025.12 | 43 |