Reasoning on AIME 2025 (Pass@1)
67.66Pass@1FP16
Evaluation Results
| Method | Links | |
|---|---|---|
| FP16Model=Qwen3-8B, Speedup=1.0×2026.05 | 67.66 | |
| LAQuantModel=Qwen3-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.45×2026.05 | 66.98 | |
| GPTQModel=Qwen3-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.45×2026.05 | 65.21 | |
| ParoQModel=Qwen3-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.32×2026.05 | 64.52 | |
| ParoQ++Model=Qwen3-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.32×2026.05 | 64.27 | |
| FP16Model=Qwen3-4B, Speedup=1.0×2026.05 | 63.75 | |
| LAQuantModel=Qwen3-4B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.0×2026.05 | 62.66 | |
| ParoQ++Model=Qwen3-4B, Quantization Bit-width=4-bit, Group Size=128, Speedup=1.84×2026.05 | 61.72 | |
| ParoQModel=Qwen3-4B, Quantization Bit-width=4-bit, Group Size=128, Speedup=1.84×2026.05 | 60.78 | |
| R-QATModel=Qwen3-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.45×2026.05 | 59.48 | |
| GPTQModel=Qwen3-4B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.0×2026.05 | 58.67 | |
| R-QATModel=Qwen3-4B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.0×2026.05 | 57.66 | |
| FP16Model=Qwen3-1.7B, Speedup=1.0×2026.05 | 35.94 | |
| LAQuantModel=Qwen3-1.7B, Quantization Bit-width=4-bit, Group Size=128, Speedup=1.64×2026.05 | 35.47 | |
| ParoQ++Model=Qwen3-1.7B, Quantization Bit-width=4-bit, Group Size=128, Speedup=1.48×2026.05 | 32.71 | |
| ParoQModel=Qwen3-1.7B, Quantization Bit-width=4-bit, Group Size=128, Speedup=1.48×2026.05 | 32.55 | |
| LAQuantModel=R1-Distill-Llama-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.46×2026.05 | 31.77 | |
| FP16Model=R1-Distill-Llama-8B, Speedup=1.0×2026.05 | 31.2 | |
| GPTQModel=R1-Distill-Llama-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.46×2026.05 | 29.85 | |
| R-QATModel=R1-Distill-Llama-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.46×2026.05 | 29.53 | |
| ParoQModel=R1-Distill-Llama-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.33×2026.05 | 28.54 | |
| ParoQ++Model=R1-Distill-Llama-8B, Quantization Bit-width=4-bit, Group Size=128, Speedup=2.33×2026.05 | 27.6 | |
| R-QATModel=Qwen3-1.7B, Quantization Bit-width=4-bit, Group Size=128, Speedup=1.64×2026.05 | 27.29 | |
| GPTQModel=Qwen3-1.7B, Quantization Bit-width=4-bit, Group Size=128, Speedup=1.64×2026.05 | 25.47 |