ResearchTasks(T+A)→I Cross-modal AlignmentFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedImage-Text-AudioOmniFlow30.76CLIP Score16Jun 16, 2026