ResearchDatasetsAudio-Visual Generation BenchmarkFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsText-and-Image to Audio-Visual GenerationAudio-Visual Generation Benchmark (test)4.15VA6Text to Audio-Visual GenerationAudio-Visual Generation Benchmark (test)4.63VA4