ResearchDatasetsLanguage Modeling BenchmarksFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsLanguage ModelingLanguage Modeling Benchmarks (ARC, BoolQ, Hellaswag, OBQA, PIQA, WinoG) zero-shot27.9ARC-E Accuracy5
Language ModelingLanguage Modeling Benchmarks (ARC, BoolQ, Hellaswag, OBQA, PIQA, WinoG) zero-shot27.9ARC-E Accuracy5