Loco-navigation Goal-conditioned Reinforcement Learning on antmaze play
98Success RateSAW
Evaluation Results
| Method | Links | |
|---|---|---|
| SAWBackbone RL Algorithm=SAW, Test-time Training (TTT) variant=None (Pre-trained)2025.07 | 98 | |
| SAW + TTTBackbone RL Algorithm=SAW, Test-time Training (TTT) variant=GC-TTT2025.07 | 97 | |
| GC-BC + TTTBackbone RL Algorithm=GC-BC, Test-time Training (TTT) variant=GC-TTT2025.07 | 76 | |
| GC-IQL-DDPG + TTTBackbone RL Algorithm=GC-IQL-DDPG, Test-time Training (TTT) variant=GC-TTT2025.07 | 68 | |
| GC-BCBackbone RL Algorithm=GC-BC, Test-time Training (TTT) variant=None (Pre-trained)2025.07 | 47 | |
| GC-IQL-DDPGBackbone RL Algorithm=GC-IQL-DDPG, Test-time Training (TTT) variant=None (Pre-trained)2025.07 | 24 |