ResearchDatasetsAudioCaptionFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsText-to-Audio GenerationAudioCaption (test)0.526CLAP Score6