Offline Reinforcement Learning on Kitchen v0 (partial)
13.8Normalized ReturnPrivORL-j
Evaluation Results
| Method | Links | |
|---|---|---|
| PrivORL-jRL Algorithm=IQL, epsilon=102025.12 | 13.8 | |
| PrivORL-jRL Algorithm=TD3PLUSBC, epsilon=102025.12 | 8.3 | |
| PrivORL-jRL Algorithm=IQL, epsilon=12025.12 | 7.5 | |
| PrivORL-jRL Algorithm=TD3PLUSBC, epsilon=12025.12 | 5 | |
| DP-TransformerRL Algorithm=IQL, epsilon=102025.12 | 2.5 | |
| PrivORL-j-URL Algorithm=EDAC, epsilon=12025.12 | 0 | |
| PrivORL-j-URL Algorithm=EDAC, epsilon=102025.12 | 0 | |
| DP-TransformerRL Algorithm=EDAC, epsilon=12025.12 | 0 | |
| DP-TransformerRL Algorithm=EDAC, epsilon=102025.12 | 0 | |
| PrivORL-jRL Algorithm=EDAC, epsilon=12025.12 | 0 | |
| PrivORL-jRL Algorithm=EDAC, epsilon=102025.12 | 0 | |
| PrivORL-j-URL Algorithm=IQL, epsilon=12025.12 | 0 | |
| PrivORL-j-URL Algorithm=IQL, epsilon=102025.12 | 0 | |
| DP-TransformerRL Algorithm=IQL, epsilon=12025.12 | 0 | |
| PrivORL-j-URL Algorithm=TD3PLUSBC, epsilon=12025.12 | 0 | |
| PrivORL-j-URL Algorithm=TD3PLUSBC, epsilon=102025.12 | 0 | |
| DP-TransformerRL Algorithm=TD3PLUSBC, epsilon=12025.12 | 0 | |
| DP-TransformerRL Algorithm=TD3PLUSBC, epsilon=102025.12 | 0 |