ResearchTasksTokenization EfficiencyFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast Updated1.5-million sentence evaluation corpus EnglishDeepSeek V37,904,670Other Tokens Count3Mar 27, 20261.5-million sentence evaluation corpus HindiOpenAI (o200k)18,394,075Other Tokens3Mar 27, 20261.5-million sentence evaluation corpus (Sinhala)OpenAI (o200k)17,360,196Other Token Count3Mar 27, 2026Page 3 of 3PreviousNext
1.5-million sentence evaluation corpus (Sinhala)OpenAI (o200k)17,360,196Other Token Count3Mar 27, 2026