ResearchTasksCross-modal classification (Visual to Audio)FollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedVGGSound-AVEL 90K UCF to VGGMICU73.7Precision4May 13, 2026