Reinforcement Learning
Benchmarks
Dataset NameSOTA methodMetricTrendResultsLast Updated
16.2Score
4
Mar 10, 2026
69.87Mean CHNS
4
Feb 26, 2026
1,187.5Max Agent Score
4
Feb 26, 2026
12,326.7Max Agent Score
4
Feb 26, 2026
6,463.7Max Score
4
Feb 26, 2026
10,964.95Max Agent Score
4
Feb 26, 2026
244.71Cartpole Score
4
Feb 26, 2026
516.69Cartpole Score
4
Feb 26, 2026
861.05Cartpole Score
4
Feb 26, 2026
423.3Alien Score
4
Feb 26, 2026
9.3Cumulative Reward
4
Feb 26, 2026
3.3Cumulative Reward
4
Feb 26, 2026
32Score (Subset 100)
4
Feb 26, 2026
1,510.8Alien Score
4
Feb 26, 2026
30,826.4Maximum Agent Score
4
Feb 26, 2026
2,300Best Stable Score
4
Feb 26, 2026
20Best Score
4
Feb 26, 2026
500Best Stable Score
4
Feb 26, 2026
3,200Reward
4
Feb 26, 2026
18.5Reward
4
Feb 26, 2026
87.5Task Success Rate
4
Feb 26, 2026
2,300Score (Seaquest)
4
Feb 26, 2026
146Number of RL Libraries
3
Jun 25, 2026
100Normalized Score
3
Jun 16, 2026
4,956.37Average Return
3
Jun 16, 2026