Reinforcement Learning
Benchmarks
Dataset NameSOTA methodMetricTrendResultsLast Updated
95.2Normalized Return
4
Feb 26, 2026
92.4Normalized Return
4
Feb 26, 2026
80.5Normalized Return
4
Feb 26, 2026
44.9Normalized Return
4
Feb 26, 2026
54.7Normalized Return
4
Feb 26, 2026
0.927Normalized Return
4
Feb 26, 2026
146.1Normalized Return
4
Feb 26, 2026
136Normalized Return
4
Feb 26, 2026
102Normalized Return
4
Feb 26, 2026
130.6Normalized Return
4
Feb 26, 2026
94.2Normalized Return
4
Feb 26, 2026
94.5Normalized Return
4
Feb 26, 2026
106Normalized Return
4
Feb 26, 2026
99Normalized Return
4
Feb 26, 2026
-7.1Reward
4
Feb 26, 2026
3,383Reward
4
Feb 26, 2026
6,036Reward
4
Feb 26, 2026
11,515Reward
4
Feb 26, 2026
-7.2Reward
4
Feb 26, 2026
2,830Reward
4
Feb 26, 2026
3,380Total Reward
4
Feb 26, 2026
7,559Reward
4
Feb 26, 2026
-8.3Reward
4
Feb 26, 2026
4,409Reward
4
Feb 26, 2026
5,320Reward
4
Feb 26, 2026