ResearchTasksMalicious AI Agent Skill DetectionFollowBenchmarksDataset NameSOTA MethodSortMost resultsRecently updatedMost papersApplyDataset NameSOTA methodMetricTrendResultsLast Updated400 labeled skills (89 malicious, 311 benign)SkillSieve L1 + Single prompt100Precision4Apr 9, 2026