ResearchBenchmarksReinforcement Learning on Kangaroo Atari (classical)Follow131,842RewardH2RL++-5,210.2430,370.6365,951.5101,532.37Mar 6, 2026Evaluation ResultsMethodMethodLinksRewardH2RL++2026.03131,842PPO2026.0314,592hPPO2026.0310,601H2RL2026.035,148H2RL+2026.032,754hReason2026.031,701BlendRL2026.031,482NUDGE2026.03404hDQN2026.03322Option-critic2026.0361