Offline Reinforcement Learning on Rotational Reacher Suboptimal
0.85ReturnDAC-Output
Evaluation Results
| Method | Links | |
|---|---|---|
| DAC-OutputAlgorithm=IQL, Zero-shot Policy Transfer=true, Rotation Group=C4 (90°)2026.07 | 0.85 | |
| Aug-DAlgorithm=IQL, Zero-shot Policy Transfer=true, Rotation Group=C4 (90°)2026.07 | 0.61 | |
| DAC-LatentAlgorithm=IQL, Zero-shot Policy Transfer=true, Rotation Group=C4 (90°)2026.07 | 0.61 | |
| Aug-D-OnlineAlgorithm=IQL, Zero-shot Policy Transfer=true, Rotation Group=C4 (90°)2026.07 | 0.59 | |
| No DAAlgorithm=IQL, Zero-shot Policy Transfer=true, Data Augmentation=None2026.07 | 0.32 |