Defense against adversarial prompts on Sneaky (test)
45.16Attack Success RateSDv1.5
Evaluation Results
| Method | Links | |
|---|---|---|
| SDv1.5Base Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 45.16 | |
| SPMBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 33.06 | |
| SLD-strongBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 27.42 | |
| MicrosoftBase Model=SDv1.5, Evaluation Classifier=filtering accuracy2026.07 | 18.21 | |
| OpenAIBase Model=SDv1.5, Evaluation Classifier=filtering accuracy2026.07 | 18.21 | |
| SAFREEBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 10.48 | |
| Latent GuardBase Model=SDv1.5, Evaluation Classifier=filtering accuracy2026.07 | 8.76 | |
| UCEBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 6.45 | |
| GuardT2IBase Model=SDv1.5, Evaluation Classifier=filtering accuracy2026.07 | 4.47 | |
| GLoCEBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 2.42 | |
| AdvUnlearnBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 1.61 | |
| ESDBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 0.81 | |
| SalUnBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 0 | |
| DESBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 0 | |
| SAGEBase Model=SDv1.5, Evaluation Classifier=NudeNet2026.07 | 0 |