Mathematical Reasoning on AIME '25 (@1, @32)
32.3Accuracy @1AVERAGE
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| AVERAGEBase Model=OLMo-3-7B, Setting=RL Zero, Fine-tuning=RLVR2026.04 | 32.3 | 66.7 | |
| TSVBase Model=OLMo-3-7B, Setting=RL Zero, Fine-tuning=RLVR, Scaling Factor (alpha)=12026.04 | 32 | 63.3 | |
| ISO-CBase Model=OLMo-3-7B, Setting=RL Zero, Fine-tuning=RLVR, Scaling Factor (alpha)=12026.04 | 31.5 | 53.3 | |
| TABase Model=OLMo-3-7B, Setting=RL Zero, Fine-tuning=RLVR, Scaling Factor (alpha)=0.42026.04 | 31.1 | 66.7 | |
| EXPERTBase Model=OLMo-3-7B, Setting=RL Zero, Fine-tuning=RLVR2026.04 | 30.7 | 66.7 | |
| ACTMatBase Model=OLMo-3-7B, Setting=RL Zero, Fine-tuning=RLVR2026.04 | 29.8 | 66.7 | |
| REGMEANBase Model=OLMo-3-7B, Setting=RL Zero, Fine-tuning=RLVR2026.04 | 27.8 | 60 | |
| ZERO-SHOTBase Model=OLMo-3-7B, Setting=RL Zero, Fine-tuning=RLVR2026.04 | 21.6 | 53.3 |