Video Question Answering on VCGBench (test)
3.51ScoreLLaVAOneVision-7B
Evaluation Results
| Method | Links | |
|---|---|---|
| LLaVAOneVision-7BTraining Mode=SFT, Video Data=true, Model Size=7B2024.09 | 3.51 | |
| LLaVA-NeXT-Interleave-7BTraining Mode=SFT, Video Data=true, Model Size=7B2024.09 | 3.42 | |
| MM1.5-Video-7BTraining Mode=SFT, Video Data=true, Model Size=7B2024.09 | 3.22 | |
| MM1.5-Video-3BTraining Mode=SFT, Video Data=true, Model Size=3B2024.09 | 3.17 | |
| MM1.5-Video-1BTraining Mode=SFT, Video Data=true, Model Size=1B2024.09 | 3.14 | |
| Video-LLaMA2-7BTraining Mode=SFT, Video Data=true, Model Size=7B2024.09 | 3.13 | |
| LLaVAOneVision-0.5BTraining Mode=SFT, Video Data=true, Model Size=0.5B2024.09 | 3.12 | |
| LLaVA-NeXT-Interleave-0.5BTraining Mode=SFT, Video Data=true, Model Size=0.5B2024.09 | 3.07 | |
| MM1.5-Video-7BTraining Mode=Training-free, Video Data=false, Model Size=7B2024.09 | 3.05 | |
| SlowFast-LLaVA-7BTraining Mode=Training-free, Video Data=false, Model Size=7B2024.09 | 3.04 | |
| MM1.5-Video-3BTraining Mode=Training-free, Video Data=false, Model Size=3B2024.09 | 3.04 | |
| IG-VLM-7B (LLaVA-v1.6)Training Mode=Training-free, Video Data=false, Model Size=7B2024.09 | 3.03 | |
| VideoChat2-7BTraining Mode=SFT, Video Data=true, Model Size=7B2024.09 | 2.98 | |
| MM1.5-Video-1BTraining Mode=Training-free, Video Data=false, Model Size=1B2024.09 | 2.86 | |
| Video-LLaVA-7BTraining Mode=SFT, Video Data=true, Model Size=7B2024.09 | 2.84 | |
| VideoChatGPT-7BTraining Mode=SFT, Video Data=true, Model Size=7B2024.09 | 2.42 |