NLP Benchmarks
Benchmarks
Task NameDataset NameSOTA ResultTrendResults
Few-shot NLP Benchmarks (HS, WG, OBQA, ARC-E, ARC-C, PIQA, SIQA, Story)
0.555HS Accuracy
8
NLP Benchmarks SST-2, WiC, PIQA, MNLI, ANLI, Social IQA, HellaSwag, ARC, RTE, MRPC, QNLI, Banking77, Clinc150
89Model Depth
7