ResearchTasksZero-shot Language Modeling EvaluationFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedSmolLM Tasks (ARC, CommonsenseQA, HellaSwag, MMLU, OpenBookQA, PIQA, WinoGrande, TriviaQA) (test)MLP MKC+1.833Average Rank4Feb 26, 2026
SmolLM Tasks (ARC, CommonsenseQA, HellaSwag, MMLU, OpenBookQA, PIQA, WinoGrande, TriviaQA) (test)MLP MKC+1.833Average Rank4Feb 26, 2026