ResearchDatasetsStandard Benchmarks (ARC-Challenge, HellaSwag, Lambada, PIQA, WinoGrande)FollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsMultiple Choice ClassificationStandard Benchmarks (ARC-Challenge, HellaSwag, Lambada, PIQA, WinoGrande) Zero-Shot56.31ARC-C Accuracy9
Multiple Choice ClassificationStandard Benchmarks (ARC-Challenge, HellaSwag, Lambada, PIQA, WinoGrande) Zero-Shot56.31ARC-C Accuracy9