Prompt Injection Detection on DeepsetPI
71F1 ScoreApriel Guard
Evaluation Results
| Method | Links | |
|---|---|---|
| Apriel GuardModel Size=8B, Reasoning=true2025.12 | 71 | |
| Apriel GuardModel Size=8B, Reasoning=false2025.12 | 68 | |
| IBM Granite GuardianVersion=3.1, Model Size=2B, Reasoning=false2025.12 | 45 | |
| IBM Granite GuardianVersion=3.3, Model Size=8B, Reasoning=false2025.12 | 32 | |
| IBM Granite GuardianVersion=3.3, Model Size=8B, Reasoning=true2025.12 | 32 | |
| Llama Prompt Guard 2Model Size=0.086B, Reasoning=false2025.12 | 29 | |
| IBM Granite GuardianVersion=3.2, Model Size=3B, Reasoning=false2025.12 | 29 | |
| Qwen3GuardModel Size=8B, Constraint=strict, Reasoning=false2025.12 | 29 | |
| IBM Granite GuardianVersion=3.2, Model Size=5B, Reasoning=false2025.12 | 28 | |
| Llama GuardVersion=3, Reasoning=false2025.12 | 26 | |
| gpt-oss-safeguardModel Size=20B, Reasoning=true2025.12 | 21 | |
| Llama GuardVersion=2, Reasoning=false2025.12 | 18 | |
| Llama GuardVersion=4, Reasoning=false2025.12 | 18 | |
| ShieldGemmaModel Size=9B, Reasoning=false2025.12 | 15 | |
| Qwen3GuardModel Size=8B, Constraint=loose, Reasoning=false2025.12 | 0 |