Reinforcement Learning on Ant-Dir Expert OOD
262Average ReturnUNICORN-SS
Evaluation Results
| Method | Links | |
|---|---|---|
| UNICORN-SS2024.02 | 262 | |
| FOCAL2024.02 | 246 | |
| UNICORN-SUP2024.02 | 229 | |
| Supervised2024.02 | 215 | |
| CSRO2024.02 | 202 | |
| MACAW2024.02 | 1 | |
| Prompt-DT2024.02 | 1 | |
| CORRO2024.02 | -14 |