ResearchDatasetsTVFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsNatural Language GenerationTV RNNLG benchmark (test)0.529BLEU Score4