Reinforcement Learning on DMControl ball-in-cup-catch (random)
92.81Normalized ScoreCQL+S2P
Evaluation Results
| Method | Links | |
|---|---|---|
| CQL+S2PBase Algorithm=CQL, S2P Augmentation=true2022.09 | 92.81 | |
| SLAC-off+S2PBase Algorithm=SLAC-off, S2P Augmentation=true2022.09 | 85.57 | |
| CQLBase Algorithm=CQL, S2P Augmentation=false2022.09 | 84.87 | |
| IQL+S2PBase Algorithm=IQL, S2P Augmentation=true2022.09 | 82.28 | |
| IQLBase Algorithm=IQL, S2P Augmentation=false2022.09 | 74.77 | |
| SLAC-offBase Algorithm=SLAC-off, S2P Augmentation=false2022.09 | 70.04 |