ResearchBenchmarksReinforcement Learning on Seaquest Atari (classical)Follow4,759RewardH2RL++-150.841,123.832,398.53,673.17Mar 6, 2026Evaluation ResultsMethodMethodLinksRewardH2RL++2026.034,759PPO2026.033,247H2RL2026.032,812hPPO2026.031,906H2RL+2026.031,802hReason2026.031,186BlendRL2026.03117hDQN2026.03112NUDGE2026.0363Option-critic2026.0338