Reinforcement Learning on Rotational Reacher Expert context 1 (test)
0.96ReturnDAC-Output
Evaluation Results
| Method | Links | |
|---|---|---|
| DAC-OutputAlgorithm=CQL, Data Augmentation Approach=Consistency on Outputs2026.07 | 0.96 | |
| DAC-LatentAlgorithm=CQL, Data Augmentation Approach=Consistency on Latents2026.07 | 0.9 | |
| Aug-DAlgorithm=CQL, Data Augmentation Approach=Offline Data Augmentation2026.07 | 0.89 | |
| Aug-D-OnlineAlgorithm=CQL, Data Augmentation Approach=Online Data Augmentation2026.07 | 0.88 | |
| No DAAlgorithm=CQL, Data Augmentation Approach=None2026.07 | 0.54 |