Reinforcement Learning on Rotational Reacher Mixed dataset context 1 (test)
0.78ReturnDAC-Output
Evaluation Results
| Method | Links | |
|---|---|---|
| DAC-OutputAlgorithm=CQL, Data Augmentation Approach=Consistency on Outputs2026.07 | 0.78 | |
| Aug-DAlgorithm=CQL, Data Augmentation Approach=Offline Data Augmentation2026.07 | 0.76 | |
| Aug-D-OnlineAlgorithm=CQL, Data Augmentation Approach=Online Data Augmentation2026.07 | 0.76 | |
| DAC-LatentAlgorithm=CQL, Data Augmentation Approach=Consistency on Latents2026.07 | 0.69 | |
| No DAAlgorithm=CQL, Data Augmentation Approach=None2026.07 | 0.36 |