ResearchDatasetsMacro-averagedFollowBenchmarksTask NameDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyTask NameDataset NameSOTA ResultTrendResultsLLM security defenseMacro-averaged GPT-4o, Llama-3 8B, and Mistral-7B (test)11.3Attack Success Rate (ASR)6
LLM security defenseMacro-averaged GPT-4o, Llama-3 8B, and Mistral-7B (test)11.3Attack Success Rate (ASR)6