ResearchDatasetsSmolLM TasksFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsZero-shot Language Modeling EvaluationSmolLM Tasks (ARC, CommonsenseQA, HellaSwag, MMLU, OpenBookQA, PIQA, WinoGrande, TriviaQA) (test)1.833Average Rank4
Zero-shot Language Modeling EvaluationSmolLM Tasks (ARC, CommonsenseQA, HellaSwag, MMLU, OpenBookQA, PIQA, WinoGrande, TriviaQA) (test)1.833Average Rank4