Reinforcement Learning on ant 2-p
146.1Normalized ReturnFlex-f-Q
Evaluation Results
| Method | Links | |
|---|---|---|
| Flex-f-Q2026.02 | 146.1 | |
| Flex-f-DICE2026.02 | 129.3 | |
| Opti-DICE2026.02 | 126.6 | |
| IQL2026.02 | 120.3 |
| Method | Links | |
|---|---|---|
| Flex-f-Q2026.02 | 146.1 | |
| Flex-f-DICE2026.02 | 129.3 | |
| Opti-DICE2026.02 | 126.6 | |
| IQL2026.02 | 120.3 |