ResearchTasks(T+I)→A Cross-modal AlignmentFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedImage-Text-AudioTangoFlux46.96CLAP Score16Jun 16, 2026