Natural language generation
Benchmarks
Dataset NameSOTA methodMetricTrendResultsLast Updated
2.46Naturalness
4
Feb 26, 2026
2.48Naturalness
4
Feb 26, 2026
2.46Naturalness
4
Feb 26, 2026
28.6BLEU
4
Feb 26, 2026
22.2BLEU Score
4
Feb 26, 2026
29.4BLEU
4
Feb 26, 2026
52.38BLEU
4
Feb 26, 2026
0.529BLEU Score
4
Feb 26, 2026
71.06ROUGE-L
3
Feb 26, 2026
3.34Performance Score
2
Jun 15, 2026
52.27BLEU Score
2
Feb 26, 2026