ResearchDatasetsAudioCaps, Clotho, and MECATFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsText-to-Text Retrieval (T2T)AudioCaps, Clotho, and MECAT Mean46.46R@113Text-to-Audio Retrieval (T2A)AudioCaps, Clotho, and MECAT Mean0.221Recall@113