Multi-turn Dialogue on MT-Bench (MT-Bench Score)
76.19MT-Bench ScoreQwen3-Omni-30B-A3B-Thinking
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen3-Omni-30B-A3B-ThinkingModel Category=Large Sized Large Audio Language Models, Parameter Count=>20B parameters2025.09 | 76.19 | |
| Gemini2.5-FlashModel Category=Proprietary Audio Language Models2025.09 | 74.5 | |
| Whisper-Large-v3 + GPT-oSS-20BModel Category=Cascaded Systems2025.09 | 71.5 | |
| Voxtral-Small-24BModel Category=Large Sized Large Audio Language Models, Parameter Count=>20B parameters2025.09 | 70.81 | |
| GPT-4o-transcribe + GPT-4.1-miniModel Category=Cascaded Systems2025.09 | 67.62 | |
| Voxtral-Mini-3BModel Category=Small-sized Audio Language Models, Parameter Count=<5B parameters2025.09 | 65.88 | |
| GPT-4o-mini-audioModel Category=Proprietary Audio Language Models2025.09 | 65 | |
| Qwen2.5-Omni-7BModel Category=Medium Sized Large Audio Language Models, Parameter Count=5B-20B parameters2025.09 | 64.56 | |
| Phi-4-Multi-modalModel Category=Medium Sized Large Audio Language Models, Parameter Count=5B-20B parameters2025.09 | 64.12 | |
| Qwen2.5-Omni-3BModel Category=Small-sized Audio Language Models, Parameter Count=<5B parameters2025.09 | 59.81 | |
| Kimi-AudioModel Category=Medium Sized Large Audio Language Models, Parameter Count=5B-20B parameters2025.09 | 54.62 | |
| ξ-DPOBackbone=Gemma2-Instruct (9B)2026.05 | 9 | |
| I-DPO + MaPPOModel=Qwen2.5-32B-Instruct2025.07 | 8.99 | |
| I-DPOModel=Qwen2.5-32B-Instruct2025.07 | 8.97 | |
| DPO + MaPPOModel=Qwen2.5-32B-Instruct2025.07 | 8.9 | |
| ITModel=Qwen2.5-32B-Instruct2025.07 | 8.89 | |
| DPO + TPO2026.05 | 8.81 | |
| I-DPO + MaPPOModel=Qwen2.5-14B-Instruct2025.07 | 8.8 | |
| DPO + Topo-TPO2026.05 | 8.8 | |
| DPO + MaPPOModel=Qwen2.5-7B-Instruct2025.07 | 8.79 | |
| DPO + MaPPOModel=Qwen2.5-14B-Instruct2025.07 | 8.68 | |
| Qwen+UFTPhase=Instruction-tuning and alignment data comparison2024.10 | 8.67 | |
| DPO2026.05 | 8.65 | |
| Qwen+SFT+DPOPhase=Instruction-tuning and alignment data comparison2024.10 | 8.64 | |
| I-DPOModel=Qwen2.5-14B-Instruct2025.07 | 8.64 | |
| ITModel=Qwen2.5-14B-Instruct2025.07 | 8.62 | |
| ITModel=Qwen2.5-7B-Instruct2025.07 | 8.61 | |
| Qwen+SFT+KTOPhase=Instruction-tuning and alignment data comparison2024.10 | 8.58 | |
| Qwen+SFT+UNAPhase=Instruction-tuning and alignment data comparison2024.10 | 8.57 | |
| DPOModel=Qwen2.5-7B-Instruct2025.07 | 8.56 | |
| I-DPOModel=Qwen2.5-7B-Instruct2025.07 | 8.55 | |
| I-DPO + MaPPOModel=Qwen2.5-7B-Instruct2025.07 | 8.54 | |
| SFTBackbone=Gemma2-Instruct (9B)2026.05 | 8.5 | |
| DPOBackbone=Gemma2-Instruct (9B)2026.05 | 8.5 | |
| DPOModel=Qwen2.5-32B-Instruct2025.07 | 8.47 | |
| DPOModel=Qwen2.5-14B-Instruct2025.07 | 8.46 | |
| IPOBackbone=Llama3-Instruct (8B)2026.05 | 8.3 | |
| ORPOBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8.3 | |
| KTOBackbone=Llama3-Instruct (8B)2026.05 | 8.2 | |
| ξ-DPOBackbone=Llama3-Instruct (8B)2026.05 | 8.2 | |
| DPOBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8.2 | |
| IPOBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8.2 | |
| CPOBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8.2 | |
| KTOBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8.2 | |
| R-DPOBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8.2 | |
| DPO + MaPPOModel=Llama-3-8B-Instruct2025.07 | 8.18 | |
| DPO + MaPPOModel=Qwen2.5-3B-Instruct2025.07 | 8.13 | |
| I-DPOModel=Qwen2.5-3B-Instruct2025.07 | 8.1 | |
| SFTBackbone=Llama3-Instruct (8B)2026.05 | 8.1 | |
| SFTBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8.1 | |
| DPOModel=Llama-3-8B-Instruct2025.07 | 8.07 | |
| I-DPO + MaPPOModel=Llama-3-8B-Instruct2025.07 | 8.04 | |
| DPOModel=Qwen2.5-3B-Instruct2025.07 | 8.02 | |
| I-DPOModel=Llama-3-8B-Instruct2025.07 | 8.01 | |
| I-DPO + MaPPOModel=Qwen2.5-3B-Instruct2025.07 | 8.01 | |
| DPOBackbone=Llama3-Instruct (8B)2026.05 | 8 | |
| CPOBackbone=Llama3-Instruct (8B)2026.05 | 8 | |
| ORPOBackbone=Llama3-Instruct (8B)2026.05 | 8 | |
| R-DPOBackbone=Llama3-Instruct (8B)2026.05 | 8 | |
| SimPOBackbone=Llama3-Instruct (8B)2026.05 | 8 | |
| SimPOBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8 | |
| ξ-DPOBackbone=Llama3-Instruct v0.2 (8B)2026.05 | 8 | |
| QwenPhase=Instruction-tuning data comparison2024.10 | 7.97 | |
| Qwen+UFTPhase=Instruction-tuning data comparison2024.10 | 7.95 | |
| ITModel=Qwen2.5-3B-Instruct2025.07 | 7.92 | |
| Qwen+SFTPhase=Instruction-tuning data comparison2024.10 | 7.85 | |
| IPOBackbone=Mistral-Instruct (7B)2026.05 | 7.8 | |
| KTOBackbone=Mistral-Instruct (7B)2026.05 | 7.7 | |
| ORPOBackbone=Mistral-Instruct (7B)2026.05 | 7.7 | |
| ξ-DPOBackbone=Mistral-Instruct (7B)2026.05 | 7.7 | |
| I-DPO + MaPPOModel=Qwen2.5-1.5B-Instruct2025.07 | 7.63 | |
| DPOBackbone=Mistral-Instruct (7B)2026.05 | 7.6 | |
| SimPOBackbone=Mistral-Instruct (7B)2026.05 | 7.6 | |
| I-DPO + MaPPOModel=Mistral-7B-Instruct2025.07 | 7.59 | |
| DPO + MaPPOModel=Qwen2.5-1.5B-Instruct2025.07 | 7.57 | |
| ITModel=Llama-3-8B-Instruct2025.07 | 7.52 | |
| DPO + MaPPOModel=Mistral-7B-Instruct2025.07 | 7.51 | |
| SFTBackbone=Mistral-Instruct (7B)2026.05 | 7.5 | |
| CPOBackbone=Mistral-Instruct (7B)2026.05 | 7.5 | |
| R-DPOBackbone=Mistral-Instruct (7B)2026.05 | 7.5 | |
| I-DPOModel=Qwen2.5-1.5B-Instruct2025.07 | 7.39 | |
| DPOModel=Qwen2.5-1.5B-Instruct2025.07 | 7.29 | |
| ITModel=Qwen2.5-1.5B-Instruct2025.07 | 7.06 | |
| I-DPOModel=Mistral-7B-Instruct2025.07 | 6.92 | |
| DPOModel=Mistral-7B-Instruct2025.07 | 6.86 | |
| LoRA+LLM=Llama 3.1-8B2026.05 | 6.35 | |
| LoRA-Over-MPO_RLLM=Llama 3.1-8B, rank=1282026.05 | 6.31 | |
| LoRA-Over-MPO_RLLM=Llama 3.1-8B2026.05 | 6.26 | |
| DoRALLM=Llama 3.1-8B2026.05 | 6.24 | |
| LoRA-Over-MPO_RLLM=Llama 3.1-8B, rank=322026.05 | 6.23 | |
| AdaLoRALLM=Llama 3.1-8B2026.05 | 6.19 | |
| rsLoRALLM=Llama 3.1-8B2026.05 | 6.18 | |
| LoRA-Over-MPO_PLLM=Llama 3.1-8B2026.05 | 6.16 | |
| LoRALLM=Llama 3.1-8B2026.05 | 6.15 | |
| OLoRALLM=Llama 3.1-8B2026.05 | 6.13 | |
| LoRA-Over-MPOLLM=Llama 3.1-8B2026.05 | 6.12 | |
| PiSSALLM=Llama 3.1-8B2026.05 | 6.08 | |
| LoRA-Over-SVDLLM=Llama 3.1-8B2026.05 | 6.01 | |
| LoRA-GALLM=Llama 3.1-8B2026.05 | 5.99 | |
| DoRALLM=Llama 2-7B2026.05 | 5.97 |