Mathematical Reasoning on AIME 2024 (reference set)
33.3Pass@1ScaleBiO
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| ScaleBiOBackbone=DeepSeek-R1-Distill-Qwen-1.5B, Fine-tuning=true, Training Samples=4K2024.06 | 33.3 | 33.3 | |
| RHO-LOSSBackbone=DeepSeek-R1-Distill-Qwen-1.5B, Fine-tuning=true, Training Samples=4K2024.06 | 30 | 33.3 | |
| UniformBackbone=DeepSeek-R1-Distill-Qwen-1.5B, Fine-tuning=true, Training Samples=4K2024.06 | 26.7 | 33.3 | |
| LESSBackbone=DeepSeek-R1-Distill-Qwen-1.5B, Fine-tuning=true, Training Samples=4K2024.06 | 26.7 | 33.3 |