Meta-Reinforcement Learning on Cheetah-Vel-Sparse (OOD)
296Average ReturnMetaSTAR
Evaluation Results
| Method | Links | |
|---|---|---|
| MetaSTARMeta-testing Setting=Offline2026.05 | 296 | |
| CORROMeta-testing Setting=Offline2026.05 | 260 | |
| MetaSTARMeta-testing Setting=Online2026.05 | 260 | |
| FOCALMeta-testing Setting=Offline2026.05 | 242 | |
| UNICORNMeta-testing Setting=Offline2026.05 | 238 | |
| CORROMeta-testing Setting=Online2026.05 | 216 | |
| UNICORNMeta-testing Setting=Online2026.05 | 212 | |
| FOCALMeta-testing Setting=Online2026.05 | 196 | |
| CSROMeta-testing Setting=Offline2026.05 | 169 | |
| MetaSTAREpisode=Final2026.05 | 142 | |
| CSROMeta-testing Setting=Online2026.05 | 137 | |
| UNICORNEpisode=Final2026.05 | 135 | |
| FOCALEpisode=Final2026.05 | 119 | |
| CSROEpisode=Final2026.05 | 96 | |
| CORROEpisode=Final2026.05 | 18 |