Automatic Speech Recognition on AISHELL-2 (ios)
2.29CERStepAudio 2.5 ASR
Evaluation Results
| Method | Links | |
|---|---|---|
| StepAudio 2.5 ASRMTP training=true2026.05 | 2.29 | |
| StepAudio 2.5 ASRMTP training=false2026.05 | 2.3 | |
| Step-Audio-2-miniType=Audio, Size=8B2026.02 | 2.33 | |
| Qwen3-ASR-1.7B2026.05 | 2.5 | |
| Qwen2.5-Omni-7BType=Omni, Size=7B2026.02 | 2.58 | |
| FunASR-Nano2026.05 | 2.61 | |
| Qwen3-Omni-InstructType=Omni, Size=30B-A3B2026.02 | 2.63 | |
| Ming-Lite-Omni-1.5Type=Omni, Size=19B-A2.8B2026.02 | 2.66 | |
| Doubao-ASR-26032026.05 | 2.7 | |
| Qwen2.5-Omni-3BType=Omni, Size=3B2026.02 | 2.77 | |
| Kimi-Audio-7B-InstructType=Audio, Size=7B2026.02 | 2.8 | |
| Qwen2-AudioType=Audio, Size=7B2026.02 | 3.08 | |
| Eureka-Audio-InstructType=Ours, Size=1.7B2026.02 | 3.1 | |
| Eureka-Audio-BaseType=Ours, Size=1.7B2026.02 | 3.17 | |
| MiniCPM-oType=Omni, Size=9B2026.02 | 3.42 | |
| VibeVoice-ASR2026.05 | 5.1 |