Multimodal Reasoning on Text-Audio-Vision Benchmark Level 2
86Pass@1 AccuracyOmni-AutoThink
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| Omni-AutoThinkBackbone=Qwen2.5-Omni-7B, Training=SFT + RL2025.12 | 86 | 0.24 | |
| Qwen3-OmniParameters=30B2025.12 | 66 | 0 | |
| Qwen2.5-OmniParameters=7B2025.12 | 61 | 0 |