Reinforcement Learning on ant 4-p
136Normalized ReturnFlex-f-DICE
Evaluation Results
| Method | Links | |
|---|---|---|
| Flex-f-DICE2026.02 | 136 | |
| Opti-DICE2026.02 | 126 | |
| Flex-f-Q2026.02 | 123.1 | |
| IQL2026.02 | 113.8 |
| Method | Links | |
|---|---|---|
| Flex-f-DICE2026.02 | 136 | |
| Opti-DICE2026.02 | 126 | |
| Flex-f-Q2026.02 | 123.1 | |
| IQL2026.02 | 113.8 |