Conversational Policy Enforcement on DynaGuard Repetition Human-annotated (test)
96Accuracyft-4.1-nano
Evaluation Results
| Method | Links | |
|---|---|---|
| ft-4.1-nanoCategory=Fine-tuned Model, Training Method=BARRED2026.04 | 96 | |
| GPT-5-miniCategory=LLM-as-a-Judge baseline2026.04 | 94 | |
| ft-Qwen14BCategory=Fine-tuned Model, Training Method=BARRED2026.04 | 93 | |
| ft-Qwen3BCategory=Fine-tuned Model, Training Method=BARRED2026.04 | 92 | |
| GPT-4.1Category=LLM-as-a-Judge baseline2026.04 | 90 | |
| OSS-Safeguard-20BCategory=Generic Guardrail Model2026.04 | 89 | |
| GPT-4.1-miniCategory=LLM-as-a-Judge baseline2026.04 | 58 | |
| GliderCategory=Generic Guardrail Model2026.04 | 57 | |
| GPT-4.1-nanoCategory=LLM-as-a-Judge baseline2026.04 | 52 | |
| Qwen14BCategory=LLM-as-a-Judge baseline2026.04 | 48 |