ResearchDatasetsBanglaSummEvalFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsFactual consistency evaluationBanglaSummEval human judgments, n=300 1.0 (test)0.694Pearson's r1