Multimodal Reasoning on Text-Audio-Vision Benchmark Level 1
92Pass@1 AccuracyOmni-AutoThink
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| Omni-AutoThinkBackbone=Qwen2.5-Omni-7B, Training=SFT + RL2025.12 | 92 | 0.16 | |
| Qwen2.5-OmniParameters=7B2025.12 | 86 | 0 | |
| Qwen3-OmniParameters=30B2025.12 | 77 | 0 |