ResearchTasksAudio-visual dialogue generationFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedDIADG evaluation (mean of 1000 samples)CHAT17.33FID6Jul 7, 2026