Competitive Programming on LiveCodeBench v6 (test)
56.7ScoreAReal-boba²
Evaluation Results
| Method | Links | |
|---|---|---|
| AReal-boba²Base Model=R1-Distilled-Qwen, SFT=false, RL=true, Model Size=14B, Training Data Volume=24k, Training Task Type=Real, Evaluation Protocol=avg@322026.01 | 56.7 | |
| Klear-ReasonerBase Model=Klear-Reasoner-SFT, SFT=true, RL=true, Model Size=8B, Training Data Volume=106k, Training Task Type=Real, Evaluation Protocol=avg@82026.01 | 53.1 | |
| AceReason1.1Base Model=AceReason1.1-SFT, SFT=true, RL=true, Model Size=7B, Training Task Type=Real, Evaluation Protocol=avg@82026.01 | 52.1 | |
| Klear-Reasoner-SFTBase Model=Qwen3-Base, SFT=true, RL=false, Model Size=8B, Training Data Volume=1500k, Training Task Type=Real, Evaluation Protocol=avg@82026.01 | 49.6 | |
| MiMoBase Model=MiMo-SFT, SFT=true, RL=true, Model Size=7B, Training Data Volume=130k, Training Task Type=Undisclosed, Evaluation Protocol=avg@82026.01 | 49.3 | |
| DeepCoder-PreviewBase Model=R1-Distilled-Qwen, SFT=false, RL=true, Model Size=14B, Training Data Volume=24k, Training Task Type=Real, Evaluation Protocol=pass@12026.01 | 48.5 | |
| Qwen3-8BBase Model=Qwen3-8B-Base, SFT=true, RL=false, Model Size=8B, Training Task Type=Real2026.01 | 48.4 | |
| MiMo-SFTBase Model=MiMo-Base, SFT=true, RL=false, Model Size=7B, Training Data Volume=500k, Training Task Type=Undisclosed, Evaluation Protocol=avg@82026.01 | 45.5 | |
| OCR-Qwen-InstructBase Model=Qwen2.5-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=736k, Training Task Type=Real, Evaluation Protocol=avg@642026.01 | 44.5 | |
| OpenThinker3Base Model=Qwen2.5-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=1,200k, Training Task Type=Mixed2026.01 | 40.8 | |
| Skywork-OR1Base Model=R1-Distilled-Qwen, SFT=false, RL=true, Model Size=7B, Training Data Volume=124k, Training Task Type=Real, Evaluation Protocol=avg@322026.01 | 40 | |
| OlympicCoderBase Model=Qwen2.5-Coder-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=100k, Training Task Type=Real2026.01 | 19.3 | |
| Bespoke-StratosBase Model=Qwen2.5-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=17k, Training Task Type=Real, Evaluation Protocol=pass@12026.01 | 8.57 |