ResearchDatasetsCombined Prompt Harmfulness SuiteFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsPrompt Harmfulness DetectionCombined Prompt Harmfulness Suite (ToxicChat, HarmBench, OpenAI Mod, Aegis SafetyTest, WildGuard Test)84.4Macro Avg Harmfulness Detection Rate17
Prompt Harmfulness DetectionCombined Prompt Harmfulness Suite (ToxicChat, HarmBench, OpenAI Mod, Aegis SafetyTest, WildGuard Test)84.4Macro Avg Harmfulness Detection Rate17