Mathematical Reasoning on AQUA (test)
72.44AccuracySoftCoT
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| SoftCoTBackbone=Qwen2.5-7B-Instruct, Training Objective=Language Modeling Objective, Evaluation Protocol=Projection Module Trained2025.02 | 72.44 | 75.06 | |
| Zero-Shot Assist-CoTBackbone=Qwen2.5-7B-Instruct, Training Objective=None, Evaluation Protocol=Zero-Shot2025.02 | 64.96 | 71.64 | |
| Zero-Shot CoT-UnkBackbone=Qwen2.5-7B-Instruct, Training Objective=None, Evaluation Protocol=Zero-Shot2025.02 | 64.72 | 70.6 | |
| Zero-Shot CoTBackbone=Qwen2.5-7B-Instruct, Training Objective=None, Evaluation Protocol=Zero-Shot2025.02 | 64.53 | 70.29 | |
| CoconutBackbone=Qwen2.5-7B-Instruct, Training Objective=Language Modeling Objective, Evaluation Protocol=Finetuned2025.02 | 63.39 | — | |
| LoRA Fine-TuningBackbone=Qwen2.5-7B-Instruct, Training Objective=Language Modeling Objective, Evaluation Protocol=Fine-Tuning2025.02 | 62.6 | — | |
| RKUSparsity=30%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 28.35 | — | |
| AGFSparsity=30%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 27.95 | — | |
| RKUSparsity=40%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 27.95 | — | |
| Taylor-FOSparsity=30%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 26.77 | — | |
| Wanda-StructSparsity=30%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 25.98 | — | |
| AGFSparsity=50%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 25.98 | — | |
| Taylor-FOSparsity=40%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 25.59 | — | |
| AGFSparsity=40%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 25.2 | — | |
| Wanda-StructSparsity=40%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 24.02 | — | |
| RKUSparsity=50%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 24.02 | — | |
| Taylor-FOSparsity=50%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 23.23 | — | |
| Wanda-StructSparsity=50%, Backbone=Qwen-2.5-7B, Fine-tuning steps=150, PEFT Method=LoRA2026.05 | 22.44 | — |