Language Modeling
Benchmarks
Dataset NameSOTA methodMetricTrendResultsLast Updated
17.731Perplexity (PPL)
2
Mar 20, 2026
19.819Perplexity (PPL)
2
Mar 20, 2026
6.19Perplexity (PPL)
2
Mar 19, 2026
1.763Validation Loss
2
Mar 10, 2026
2.469Validation Loss
2
Mar 10, 2026
2.94Validation Loss
2
Mar 10, 2026
1.04DM Mathematics Score
2
Feb 27, 2026
17.283Accuracy
2
Feb 26, 2026
20.54Perplexity
2
Jun 2, 2026
23.4Gen. PPL
2
Feb 26, 2026
8.9Perplexity
2
Feb 26, 2026
0.004MAE
2
Feb 26, 2026
2.756PT Train Loss
2
Feb 26, 2026
79.87PPL
2
Feb 26, 2026
4.986CL
2
Feb 26, 2026
0.902BPC (df)
2
Feb 26, 2026
0.85BPC (df)
2
Feb 26, 2026
1.789BPC (df)
2
Feb 26, 2026
3.9Training Throughput
2
Feb 26, 2026
10.89Perplexity
2
Feb 26, 2026
14.2Perplexity
2
Feb 26, 2026
107.95Perplexity
2
Feb 26, 2026
40.43Perplexity
2
Feb 26, 2026
1.3Bits Per Character
2
Feb 26, 2026
1.066BPC
2
Feb 26, 2026