Text Classification on HellaSwag
78.9AccuracyGPT-3
Evaluation Results
| Method | Links | |
|---|---|---|
| GPT-3# Params=175B, prompting_mode=zero-shot2021.07 | 78.9 | |
| I-GLASSBackbone=Mistral 7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 61.01 | |
| GRIFFINBackbone=Mistral 7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 60.97 | |
| GRIFFINBackbone=Gemma 7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 60.62 | |
| I-GLASSBackbone=Gemma 7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 60.59 | |
| I-GLASSBackbone=Llama2 7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 57.14 | |
| GRIFFINBackbone=Llama2 7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 57.14 | |
| I-GLASSBackbone=ReLU-Llama2 7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 53.95 | |
| GRIFFINBackbone=ReLU-Llama2 7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 53.95 | |
| GPT-3 Large# Params=760M, prompting_mode=zero-shot2021.07 | 51 | |
| GRIFFINBackbone=OPT 6.7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 50.49 | |
| I-GLASSBackbone=OPT 6.7B, Sparsity=50% FF, Evaluation Protocol=0-shot unnormalized2025.08 | 50.45 | |
| HTLM-Manual# Params=400M, prompting_mode=zero-shot2021.07 | 47.9 | |
| GPT-3 Med# Params=350M, prompting_mode=zero-shot2021.07 | 43.6 |