Reinforcement Learning on Atari 2600 Montezuma's Revenge (test)
14,973ScoreSND-V
Evaluation Results
| Method | Links | |
|---|---|---|
| SND-V2023.02 | 14,973 | |
| RND2018.10 | 8,152 | |
| SND-VIC2023.02 | 7,838 | |
| SND-STD2023.02 | 7,212 | |
| RND2023.02 | 6,689 | |
| Avg. Human2018.10 | 4,753 | |
| DQN-CTSTraining frames=150M, Seeds=32017.03 | 3,705.5 | |
| SOTAcitation=[2]2018.10 | 3,700 | |
| DQN-PixelCNNTraining frames=150M, Seeds=32017.03 | 2,514.3 | |
| A2C+SILSelf-Imitation Learning=true2018.06 | 2,500 | |
| PPO2018.10 | 2,497 | |
| Dynamics2018.10 | 400 | |
| Baseline2023.02 | 400 | |
| A3C-CTSTraining frames=150M, Seeds=32017.03 | 273.7 | |
| A3C-CTSExploration=CTS2018.06 | 273 | |
| Reactor-PixelCNNExploration=PixelCNN2018.06 | 100 | |
| TRPO-AE-SimHashExploration=SimHash2018.06 | 75 | |
| SND-V2023.02 | 8.87 | |
| SND-VIC2023.02 | 8.45 | |
| SND-STD2023.02 | 7.76 | |
| RND2023.02 | 5.33 | |
| DQNTraining frames=150M, Seeds=32017.03 | 0 | |
| Prior. DuelTraining frames=150M, Seeds=32017.03 | 0 | |
| Baseline2023.02 | 0 |