ResearchDatasetsLLM Foundational CapabilitiesFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsZero-shot Reasoning and Language ModelingLLM Foundational Capabilities (SciQ, PIQA, Winogrande, ARC, HellaSwag, LogiQA, BoolQ, LAMBADA) zero-shot94.1SciQ Accuracy17
Zero-shot Reasoning and Language ModelingLLM Foundational Capabilities (SciQ, PIQA, Winogrande, ARC, HellaSwag, LogiQA, BoolQ, LAMBADA) zero-shot94.1SciQ Accuracy17