Competitive Programming on LiveCodeBench v5 (test)
61.6ScoreKlear-Reasoner
Evaluation Results
| Method | Links | |
|---|---|---|
| Klear-ReasonerBase Model=Klear-Reasoner-SFT, SFT=true, RL=true, Model Size=8B, Training Data Volume=106k, Training Task Type=Real, Evaluation Protocol=avg@82026.01 | 61.6 | |
| Klear-Reasoner-SFTBase Model=Qwen3-Base, SFT=true, RL=false, Model Size=8B, Training Data Volume=1500k, Training Task Type=Real, Evaluation Protocol=avg@82026.01 | 58.5 | |
| AReal-boba²Base Model=R1-Distilled-Qwen, SFT=false, RL=true, Model Size=14B, Training Data Volume=24k, Training Task Type=Real, Evaluation Protocol=avg@322026.01 | 58.1 | |
| DeepCoder-PreviewBase Model=R1-Distilled-Qwen, SFT=false, RL=true, Model Size=14B, Training Data Volume=24k, Training Task Type=Real, Evaluation Protocol=pass@12026.01 | 57.9 | |
| MiMoBase Model=MiMo-SFT, SFT=true, RL=true, Model Size=7B, Training Data Volume=130k, Training Task Type=Undisclosed, Evaluation Protocol=avg@82026.01 | 57.8 | |
| Qwen3-8BBase Model=Qwen3-8B-Base, SFT=true, RL=false, Model Size=8B, Training Task Type=Real2026.01 | 57.5 | |
| rStar-CoderBase Model=Qwen2.5-Coder-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=580K, Training Task Type=Mixed, Evaluation Protocol=avg@162026.01 | 57.3 | |
| AceReason1.1Base Model=AceReason1.1-SFT, SFT=true, RL=true, Model Size=7B, Training Task Type=Real, Evaluation Protocol=avg@82026.01 | 57.2 | |
| MiMo-SFTBase Model=MiMo-Base, SFT=true, RL=false, Model Size=7B, Training Data Volume=500k, Training Task Type=Undisclosed, Evaluation Protocol=avg@82026.01 | 52.3 | |
| OpenThinker3Base Model=Qwen2.5-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=1,200k, Training Task Type=Mixed2026.01 | 51.7 | |
| OCR-Qwen-InstructBase Model=Qwen2.5-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=736k, Training Task Type=Real, Evaluation Protocol=avg@642026.01 | 51.3 | |
| AceReason1.1-SFTBase Model=Qwen2.5-Math, SFT=true, RL=false, Model Size=7B, Training Data Volume=2.2M, Training Task Type=Real, Evaluation Protocol=avg@82026.01 | 51.2 | |
| Skywork-OR1Base Model=R1-Distilled-Qwen, SFT=false, RL=true, Model Size=7B, Training Data Volume=124k, Training Task Type=Real, Evaluation Protocol=avg@322026.01 | 47.6 | |
| OlympicCoderBase Model=Qwen2.5-Coder-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=100k, Training Task Type=Real2026.01 | 40.9 | |
| Bespoke-StratosBase Model=Qwen2.5-Instruct, SFT=true, RL=false, Model Size=7B, Training Data Volume=17k, Training Task Type=Real, Evaluation Protocol=pass@12026.01 | 16.2 |