Mathematical Reasoning on AMC 23 (Response Length (Tokens))
6,768Response Length (Tokens)DeepSeek-R1-Distill
Evaluation Results
| Method | Links | |
|---|---|---|
| DeepSeek-R1-DistillModel Scale=1.5B, Base Model=Qwen2.5-Math2026.06 | 6,768 | |
| DeepSeek-R1-DistillModel Scale=7B, Base Model=Qwen2.5-Math2026.06 | 5,466 | |
| AdaCoTModel Scale=7B, Base Model=Qwen2.5-Math2026.06 | 3,115 | |
| S-GRPOModel Scale=1.5B, Base Model=Qwen2.5-Math2026.06 | 3,081 | |
| AdaCoTModel Scale=1.5B, Base Model=Qwen2.5-Math2026.06 | 2,936 | |
| AdaptThinkModel Scale=7B, Base Model=Qwen2.5-Math2026.06 | 2,834 | |
| AdaptThinkModel Scale=1.5B, Base Model=Qwen2.5-Math2026.06 | 2,740 | |
| LHRMsModel Scale=1.5B, Base Model=Qwen2.5-Math2026.06 | 2,477 | |
| S-GRPOModel Scale=7B, Base Model=Qwen2.5-Math2026.06 | 2,247 | |
| SuCoModel Scale=1.5B, Base Model=Qwen2.5-Math2026.06 | 1,687 | |
| LHRMsModel Scale=7B, Base Model=Qwen2.5-Math2026.06 | 1,525 | |
| SuCoModel Scale=7B, Base Model=Qwen2.5-Math2026.06 | 935 |