Offline Reinforcement Learning on D4RL AntMaze Large-Diverse v0
0.2Avg Normalized ScoreTD3+BC
Evaluation Results
| Method | Links | |
|---|---|---|
| TD3+BCEvaluations=final 10, Seeds=5, State feature normalization=false2021.06 | 0.2 |
| Method | Links | |
|---|---|---|
| TD3+BCEvaluations=final 10, Seeds=5, State feature normalization=false2021.06 | 0.2 |