Multimodal Reasoning on Text-Audio-Vision Benchmark Full Set
69Pass@1 AccuracyOmni-AutoThink
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| Omni-AutoThinkBackbone=Qwen2.5-Omni-7B, Training=SFT + RL2025.12 | 69 | 0.25 | |
| Qwen3-OmniParameters=30B2025.12 | 57 | 0 | |
| Qwen2.5-OmniParameters=7B2025.12 | 48 | 0 |