Sentence Completion on HellaSwag v1 (test)
81Normalized AccuracyMistral-7B
Evaluation Results
| Method | Links | |
|---|---|---|
| Mistral-7BTraining Tokens (B)=8000*, Evaluation Protocol=Zero-shot, Model Architecture Category=Transformer2025.07 | 81 | |
| Gemma-7BTraining Tokens (B)=6000, Evaluation Protocol=Zero-shot, Model Architecture Category=Transformer2025.07 | 80.7 | |
| Mistral-7B-LoLCATsTraining Tokens (B)=0.04, Evaluation Protocol=Zero-shot, Model Architecture Category=Linearized, Linearized Model Constraint=Bounded2025.07 | 80.7 | |
| Mistral-7B-LizardTraining Tokens (B)=0.04, Evaluation Protocol=Zero-shot, Model Architecture Category=Linearized, Linearized Model Constraint=Unbounded2025.07 | 79.8 | |
| LLaMA-3-8B-LoLCATsTraining Tokens (B)=0.04, Evaluation Protocol=Zero-shot, Model Architecture Category=Linearized, Linearized Model Constraint=Bounded2025.07 | 79.7 | |
| LLaMA-3-8B-LizardTraining Tokens (B)=0.04, Evaluation Protocol=Zero-shot, Model Architecture Category=Linearized, Linearized Model Constraint=Unbounded2025.07 | 79.3 | |
| LLaMA-3-8BTraining Tokens (B)=15000, Evaluation Protocol=Zero-shot, Model Architecture Category=Transformer2025.07 | 79.1 | |
| Griffin-7BTraining Tokens (B)=300, Evaluation Protocol=Zero-shot, Model Architecture Category=Subquadratic2025.07 | 78.6 | |
| Mamba-7BTraining Tokens (B)=1200, Evaluation Protocol=Zero-shot, Model Architecture Category=Subquadratic2025.07 | 77.9 | |
| Hawk-7BTraining Tokens (B)=300, Evaluation Protocol=Zero-shot, Model Architecture Category=Subquadratic2025.07 | 77.6 | |
| Mistral-7B-SUPRATraining Tokens (B)=100, Evaluation Protocol=Zero-shot, Model Architecture Category=Linearized, Linearized Model Constraint=Bounded2025.07 | 77.1 | |
| Liger-GLA-Mistral-7BTraining Tokens (B)=0.02, Evaluation Protocol=Zero-shot, Model Architecture Category=Linearized, Linearized Model Constraint=Bounded2025.07 | 76.3 | |
| Liger-GLA-Llama-3-8BTraining Tokens (B)=0.02, Evaluation Protocol=Zero-shot, Model Architecture Category=Linearized, Linearized Model Constraint=Bounded2025.07 | 76.3 | |
| TransNormerLLM-7BTraining Tokens (B)=1400, Evaluation Protocol=Zero-shot, Model Architecture Category=Subquadratic2025.07 | 75.2 | |
| RWKV-6-v2.1-7BTraining Tokens (B)=1420, Evaluation Protocol=Zero-shot, Model Architecture Category=Subquadratic2025.07 | 75.1 | |
| Mamba2-LLaMA-3-8BTraining Tokens (B)=20, Evaluation Protocol=Zero-shot, Model Architecture Category=Linearized, Linearized Model Constraint=Unbounded2025.07 | 70.8 |