Multimodal Understanding on MMBenchmark English (test)
68.8AccuracyShareGPT4V-7B
Evaluation Results
| Method | Links | |
|---|---|---|
| ShareGPT4V-7BLanguage Model=Vicuna-7B2023.11 | 68.8 | |
| LLaVA-1.5Language Model=Vicuna-13B2023.11 | 67.7 | |
| LLaVA-1.5Language Model=Vicuna-7B2023.11 | 64.3 | |
| Qwen-VL-ChatLanguage Model=Qwen-7B2023.11 | 60.6 | |
| ShikraLanguage Model=Vicuna-13B2023.11 | 58.8 | |
| IDEFICS-80BLanguage Model=LLaMA-65B2023.11 | 54.5 | |
| Qwen-VLLanguage Model=Qwen-7B2023.11 | 38.2 | |
| InstructBLIPLanguage Model=Vicuna-7B2023.11 | 36 | |
| LLaVALanguage Model=Vicuna-7B2023.11 | 34.1 |