LLM Pruning Evaluation on LAMBADA-Std and TriviaQA
79.3Relative Retention (Generation)SparseGPT
Evaluation Results
| Method | Links | |
|---|---|---|
| SparseGPTCalibration=mix_balanced, Model Scale=LLaMA-3.1-70B, Sparsity=60% unstructured2026.06 | 79.3 | |
| WandaCalibration=C4, Model Scale=LLaMA-3.1-70B, Sparsity=60% unstructured2026.06 | 76.32 | |
| WandaCalibration=mix_balanced, Model Scale=LLaMA-3.1-70B, Sparsity=60% unstructured2026.06 | 75.3 | |
| WandaCalibration=IGSP (ours), Model Scale=LLaMA-3.1-70B, Sparsity=60% unstructured2026.06 | 70.5 | |
| SparseGPTCalibration=MetaMath, Model Scale=LLaMA-3.1-70B, Sparsity=60% unstructured2026.06 | 69.8 | |
| SparseGPTCalibration=mix_balanced, Model Scale=LLaMA-3.1-8B, Sparsity=60% unstructured2026.06 | 59.69 | |
| MagnitudeCalibration=None, Model Scale=LLaMA-3.1-70B, Sparsity=60% unstructured2026.06 | 52.3 | |
| SparseGPTCalibration=MetaMath, Model Scale=LLaMA-3.1-8B, Sparsity=60% unstructured2026.06 | 46.2 | |
| WandaCalibration=C4, Model Scale=LLaMA-3.1-8B, Sparsity=60% unstructured2026.06 | 41.72 | |
| WandaCalibration=mix_balanced, Model Scale=LLaMA-3.1-8B, Sparsity=60% unstructured2026.06 | 40.89 | |
| WandaCalibration=IGSP (ours), Model Scale=LLaMA-3.1-8B, Sparsity=60% unstructured2026.06 | 34.63 | |
| MagnitudeCalibration=None, Model Scale=LLaMA-3.1-8B, Sparsity=60% unstructured2026.06 | 14.5 |