Reinforcement Learning on hopper 2-p
106Normalized ReturnFlex-f-Q
Evaluation Results
| Method | Links | |
|---|---|---|
| Flex-f-Q2026.02 | 106 | |
| IQL2026.02 | 100.7 | |
| Opti-DICE2026.02 | 45.2 | |
| Flex-f-DICE2026.02 | 40.8 |
| Method | Links | |
|---|---|---|
| Flex-f-Q2026.02 | 106 | |
| IQL2026.02 | 100.7 | |
| Opti-DICE2026.02 | 45.2 | |
| Flex-f-DICE2026.02 | 40.8 |