Offline Reinforcement Learning on Ant kinematic shifts
120ScoreDROCO
Evaluation Results
| Method | Links | |
|---|---|---|
| DROCOSource Policy=expert, Target Policy=expert2025.12 | 120 | |
| IGDFSource Policy=expert, Target Policy=expert2025.12 | 119.2 | |
| IGDFSource Policy=medium, Target Policy=expert2025.12 | 112.4 | |
| OTDFSource Policy=expert, Target Policy=expert2025.12 | 111.6 | |
| IQLSource Policy=expert, Target Policy=expert2025.12 | 111 | |
| DROCOSource Policy=medium, Target Policy=expert2025.12 | 110.3 | |
| IQLSource Policy=medium, Target Policy=expert2025.12 | 107.6 | |
| OTDFSource Policy=medium, Target Policy=expert2025.12 | 105.9 | |
| DROCOSource Policy=expert, Target Policy=medium2025.12 | 100.4 | |
| OTDFSource Policy=expert, Target Policy=medium2025.12 | 98.6 | |
| IQLSource Policy=expert, Target Policy=medium2025.12 | 93.7 | |
| DROCOSource Policy=medium, Target Policy=medium2025.12 | 92.7 | |
| IGDFSource Policy=expert, Target Policy=medium2025.12 | 90.2 | |
| IQLSource Policy=medium, Target Policy=medium2025.12 | 89.9 | |
| IGDFSource Policy=medium, Target Policy=medium2025.12 | 88 | |
| OTDFSource Policy=medium, Target Policy=medium2025.12 | 86.1 |