Hearing Disorder Evaluation on StutterDetect
68.7LB ScoreQwen3-Omni-30B-A3B-Thinking
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen3-Omni-30B-A3B-ThinkingModel Category=Large Sized Large Audio Language Models, Parameter Count=>20B parameters2025.09 | 68.7 | |
| Qwen2.5-Omni-7BModel Category=Medium Sized Large Audio Language Models, Parameter Count=5B-20B parameters2025.09 | 68.2 | |
| Gemini2.5-FlashModel Category=Proprietary Audio Language Models2025.09 | 64.6 | |
| Qwen2.5-Omni-3BModel Category=Small-sized Audio Language Models, Parameter Count=<5B parameters2025.09 | 58.4 | |
| Kimi-AudioModel Category=Medium Sized Large Audio Language Models, Parameter Count=5B-20B parameters2025.09 | 58.4 | |
| Voxtral-Small-24BModel Category=Large Sized Large Audio Language Models, Parameter Count=>20B parameters2025.09 | 51.9 | |
| Whisper-Large-v3 + GPT-oSS-20BModel Category=Cascaded Systems2025.09 | 49.8 | |
| GPT-4o-transcribe + GPT-4.1-miniModel Category=Cascaded Systems2025.09 | 49.7 | |
| Phi-4-Multi-modalModel Category=Medium Sized Large Audio Language Models, Parameter Count=5B-20B parameters2025.09 | 42.1 | |
| Voxtral-Mini-3BModel Category=Small-sized Audio Language Models, Parameter Count=<5B parameters2025.09 | 12.9 | |
| GPT-4o-mini-audioModel Category=Proprietary Audio Language Models2025.09 | 3.8 |