ResearchDatasetsNLP Downstream BenchmarksFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsZero-shot NLP EvaluationNLP Downstream Benchmarks (ARC, BoolQ, HellaSwag, LAMBADA, MMLU)0.354ARC-C15