Reinforcement Learning on Ant-Dir Random OOD
62Average ReturnUNICORN-SS
Evaluation Results
| Method | Links | |
|---|---|---|
| UNICORN-SS2024.02 | 62 | |
| UNICORN-SUP2024.02 | 60 | |
| Supervised2024.02 | 47 | |
| FOCAL2024.02 | 44 | |
| CSRO2024.02 | 0 | |
| CORRO2024.02 | 0 | |
| MACAW2024.02 | 0 | |
| Prompt-DT2024.02 | 0 |
| Method | Links | |
|---|---|---|
| UNICORN-SS2024.02 | 62 | |
| UNICORN-SUP2024.02 | 60 | |
| Supervised2024.02 | 47 | |
| FOCAL2024.02 | 44 | |
| CSRO2024.02 | 0 | |
| CORRO2024.02 | 0 | |
| MACAW2024.02 | 0 | |
| Prompt-DT2024.02 | 0 |