Categories
Companies
Research
Sign in
Join
Loading the SOTA2 catalog…
WizWand is now SOTA2 Research
SOTA2
Research
Papers
Benchmarks
Datasets
Tasks
Multimodal AI research – Page 68 · SOTA2 Research
Back to Research
Research domain
Multimodal
Search tasks
Search
1 benchmarks · 1 papers
Visual Question Answering for object probing
1 benchmarks · 1 papers
Soccer Refereeing Comprehensive Evaluation
1 benchmarks · 1 papers
Text-guided Image-to-Image Translation
1 benchmarks · 1 papers
Video Compositional Reasoning
1 benchmarks · 1 papers
Image-to-text subject generation
1 benchmarks · 1 papers
Vision-Language Hallucination Assessment
1 benchmarks · 1 papers
Agricultural Visual Question Answering
1 benchmarks · 2 papers
Icon Question Answering
1 benchmarks · 1 papers
Human Feedback Score Prediction
1 benchmarks · 1 papers
4D Object Question Answering
1 benchmarks · 1 papers
PDF Multimodal Understanding
1 benchmarks · 1 papers
VLM Inference Efficiency
1 benchmarks · 1 papers
Text-rich Image Question Answering (Abstract)
1 benchmarks · 1 papers
Cross-modal Translation (OSM to RGB)
1 benchmarks · 1 papers
Long multimodal document understanding
1 benchmarks · 1 papers
4D Object Captioning
1 benchmarks · 1 papers
Excessive Response
1 benchmarks · 1 papers
Speculative Advice Induction
1 benchmarks · 1 papers
Bongard Problem Inversion
1 benchmarks · 1 papers
Language Shortcut Robustness
1 benchmarks · 2 papers
Visual Storytelling Consistency
1 benchmarks · 1 papers
Audio-Visual Quality Assessment
1 benchmarks · 1 papers
Illustrated Instructions
1 benchmarks · 1 papers
VLM Editing
1 benchmarks · 1 papers
Online VideoQA
1 benchmarks · 1 papers
Vision-Language Model Editing
1 benchmarks · 1 papers
Proactive VideoQA
1 benchmarks · 1 papers
Vision Language Model Evaluation
1 benchmarks · 1 papers
General Multimodal Perception and Recognition
1 benchmarks · 1 papers
Audio-Language Understanding
1 benchmarks · 1 papers
Multimodal Visual Reasoning
1 benchmarks · 1 papers
Audio-Language Reasoning
Page 68 of 83
Previous
Next