ResearchTasksVideo-conditioned sound-speech joint generationFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast UpdatedV2C (test)VSSFlow-M19.4WER5Mar 11, 2026