ResearchDatasetsStandard Downstream BenchmarksFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsNatural Language Understanding and ReasoningStandard Downstream Benchmarks Two-Shot (val)56.86ARC-E Accuracy (Normalized)11
Natural Language Understanding and ReasoningStandard Downstream Benchmarks Two-Shot (val)56.86ARC-E Accuracy (Normalized)11