Mathematical Reasoning on GSM-Infinite 32K
15.4AccuracyFlexPrefill
Evaluation Results
| Method | Links | |
|---|---|---|
| FlexPrefillBackbone Model=Llama-3.1-8B-Inst2025.07 | 15.4 | |
| MInferenceBackbone Model=Qwen2.5-7B-Inst2025.07 | 15.1 | |
| XAttentionBackbone Model=Qwen2.5-7B-Inst2025.07 | 14.3 | |
| Ours + XAttentionBackbone Model=Qwen2.5-7B-Inst2025.07 | 14.1 | |
| FlexPrefillBackbone Model=Qwen2.5-7B-Inst2025.07 | 13.4 | |
| Ours + FlexPrefillBackbone Model=Qwen2.5-7B-Inst2025.07 | 13.4 | |
| Ours + MInferenceBackbone Model=Qwen2.5-7B-Inst2025.07 | 13.3 | |
| TriangleMixBackbone Model=Qwen2.5-7B-Inst2025.07 | 12.9 | |
| Qwen2.5-7B-InstBackbone Model=Qwen2.5-7B-Inst2025.07 | 12.8 | |
| Ours + XAttentionBackbone Model=Llama-3.1-8B-Inst2025.07 | 12 | |
| XAttentionBackbone Model=Llama-3.1-8B-Inst2025.07 | 10.6 | |
| FlexPrefillBackbone Model=Llama-3-8B-Inst-262k2025.07 | 10.2 | |
| Llama-3.1-8B-InstBackbone Model=Llama-3.1-8B-Inst2025.07 | 9.6 | |
| TriangleMixBackbone Model=Llama-3.1-8B-Inst2025.07 | 9.6 | |
| Ours + MInferenceBackbone Model=Llama-3.1-8B-Inst2025.07 | 8.9 | |
| Ours + FlexPrefillBackbone Model=Llama-3.1-8B-Inst2025.07 | 8.9 | |
| XAttentionBackbone Model=Llama-3-8B-Inst-262k2025.07 | 8.2 | |
| MInferenceBackbone Model=Llama-3.1-8B-Inst2025.07 | 8.1 | |
| TriangleMixBackbone Model=Llama-3-8B-Inst-262k2025.07 | 8.1 | |
| Llama-3-8B-Inst-262kBackbone Model=Llama-3-8B-Inst-262k2025.07 | 7.9 | |
| MInferenceBackbone Model=Llama-3-8B-Inst-262k2025.07 | 7.5 | |
| Ours + XAttentionBackbone Model=Llama-3-8B-Inst-262k2025.07 | 7.4 | |
| Ours + MInferenceBackbone Model=Llama-3-8B-Inst-262k2025.07 | 6.6 | |
| Ours + FlexPrefillBackbone Model=Llama-3-8B-Inst-262k2025.07 | 6.6 |