ResearchDatasetsUniSRM-BENCHFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsutterance-level pairwise preference judgementUniSRM-BENCH T165.06Accuracy12multi-turn dialogue speech evaluationUniSRM-BENCH T488.89Accuracy10scenario-aware style consistency preference (Chinese)UniSRM-BENCH T3-Zh91.3Accuracy10scenario-aware style consistency preference (English)UniSRM-BENCH T3-En85.61Accuracy10fine-grained speech quality scoringUniSRM-BENCH T20.551PCC9