ResearchDatasetsUltraChat × HarmBenchFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsDirectional Jailbreak DetectionUltraChat (Safe) × HarmBench (Harmful)0.956AUROC (mono)3