ResearchDatasetsPersona-ScenarioFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsDialogue NaturalnessPersona-Scenario98.55GPT-Score: Fluency3Dialogue Goal CompletionPersona-Scenario9.19Believability (Sotopia-Eval)3Dialogue Quality EvaluationPersona-Scenario3.7Believability3