Mathematical Reasoning on MathQA OOD (test)
63AccuracyRKU
Evaluation Results
| Method | Links | |
|---|---|---|
| RKUSparsity=40%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 63 | |
| RKUSparsity=30%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 61.67 | |
| Wanda-StructSparsity=50%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 60.33 | |
| RKUSparsity=50%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 60 | |
| Wanda-StructSparsity=40%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 59.33 | |
| Taylor-FOSparsity=50%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 56.33 | |
| Taylor-FOSparsity=40%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 54.33 | |
| Taylor-FOSparsity=30%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 53.33 | |
| Wanda-StructSparsity=30%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 51.67 | |
| AGFSparsity=30%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 42.58 | |
| RKUSparsity=30%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 41.88 | |
| Taylor-FOSparsity=30%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 41.54 | |
| Wanda-StructSparsity=30%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 40.2 | |
| AGFSparsity=30%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 39.13 | |
| AGFSparsity=40%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 38.46 | |
| RKUSparsity=40%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 37.45 | |
| Wanda-StructSparsity=40%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 35.71 | |
| Taylor-FOSparsity=40%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 35.38 | |
| AGFSparsity=50%, Training Source=GSM8K, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 35.04 | |
| AGFSparsity=40%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 34.81 | |
| RKUSparsity=50%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 32.46 | |
| Taylor-FOSparsity=50%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 30.79 | |
| Wanda-StructSparsity=50%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 30.59 | |
| AGFSparsity=50%, Training Source=AQuA, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 29.78 |