Reinforcement Learning on pick & place 2-p
93.2Normalized ReturnFlex-f-DICE
Evaluation Results
| Method | Links | |
|---|---|---|
| Flex-f-DICE2026.02 | 93.2 | |
| Flex-f-Q2026.02 | 92.7 | |
| IQL2026.02 | 92 | |
| Opti-DICE2026.02 | 91.6 |
| Method | Links | |
|---|---|---|
| Flex-f-DICE2026.02 | 93.2 | |
| Flex-f-Q2026.02 | 92.7 | |
| IQL2026.02 | 92 | |
| Opti-DICE2026.02 | 91.6 |