Prompt Injection Detection on SafeGuardPI
93F1 ScoreIBM Granite Guardian
Evaluation Results
| Method | Links | |
|---|---|---|
| IBM Granite GuardianVersion=3.2, Model Size=3B, Reasoning=false2025.12 | 93 | |
| IBM Granite GuardianVersion=3.1, Model Size=2B, Reasoning=false2025.12 | 92 | |
| IBM Granite GuardianVersion=3.2, Model Size=5B, Reasoning=false2025.12 | 92 | |
| IBM Granite GuardianVersion=3.3, Model Size=8B, Reasoning=false2025.12 | 90 | |
| IBM Granite GuardianVersion=3.3, Model Size=8B, Reasoning=true2025.12 | 86 | |
| Llama GuardVersion=3, Reasoning=false2025.12 | 77 | |
| Llama GuardVersion=2, Reasoning=false2025.12 | 74 | |
| Apriel GuardModel Size=8B, Reasoning=false2025.12 | 73 | |
| Apriel GuardModel Size=8B, Reasoning=true2025.12 | 73 | |
| Llama GuardVersion=4, Reasoning=false2025.12 | 70 | |
| Llama Prompt Guard 2Model Size=0.086B, Reasoning=false2025.12 | 68 | |
| gpt-oss-safeguardModel Size=20B, Reasoning=true2025.12 | 53 | |
| Qwen3GuardModel Size=8B, Constraint=strict, Reasoning=false2025.12 | 37 | |
| Qwen3GuardModel Size=8B, Constraint=loose, Reasoning=false2025.12 | 28 | |
| ShieldGemmaModel Size=9B, Reasoning=false2025.12 | 17 |