Offline Reinforcement Learning on OGBench antmaze-giant-navigate-singletask task1-v0 to task5-v0
52.2ScoreGFP
Evaluation Results
| Method | Links | |
|---|---|---|
| GFPTask=task2-v02025.12 | 52.2 | |
| ReBRACTask=task5-v02025.12 | 49 | |
| DROLPolicy Class=One-step Method, K-selection protocol=benchmark-specific2026.04 | 45 | |
| GFPTask=task5-v02025.12 | 43.2 | |
| ReBRACTask=task3-v02025.12 | 34 | |
| ReBRACTask=task1-v02025.12 | 27 | |
| ReBRACPolicy Class=Gaussian Policy2026.04 | 26 | |
| IQLTask=task5-v02025.12 | 19 | |
| GFPTask=task4-v02025.12 | 17.8 | |
| ReBRACTask=task2-v02025.12 | 16 | |
| FQLTask=task5-v02025.12 | 16 | |
| FQLTask=task4-v02025.12 | 14 | |
| GFPTask=task3-v02025.12 | 13.7 | |
| IFQLTask=task5-v02025.12 | 13 | |
| GFPTask=task1-v02025.12 | 12.6 | |
| DeFlowPolicy Class=Multi-step / Iterative Policy2026.04 | 12 | |
| FQLTask=task2-v02025.12 | 9 | |
| FBRACTask=task4-v02025.12 | 9 | |
| SORLPolicy Class=Multi-step / Iterative Policy2026.04 | 9 | |
| FQLPolicy Class=One-step Method2026.04 | 9 | |
| FBRACTask=task5-v02025.12 | 6 | |
| ReBRACTask=task4-v02025.12 | 5 | |
| FQLTask=task1-v02025.12 | 4 | |
| FBRACTask=task2-v02025.12 | 4 | |
| IQLPolicy Class=Gaussian Policy2026.04 | 4 | |
| FBRACPolicy Class=Multi-step / Iterative Policy2026.04 | 4 | |
| IFQLPolicy Class=Multi-step / Iterative Policy2026.04 | 3 | |
| DROLPolicy Class=One-step Method, K=162026.04 | 3 | |
| IQLTask=task2-v02025.12 | 1 | |
| BCTask=task5-v02025.12 | 1 | |
| BCTask=task1-v02025.12 | 0 | |
| BCPolicy Class=Gaussian Policy2026.04 | 0 | |
| FAWACPolicy Class=Multi-step / Iterative Policy2026.04 | 0 |