ResearchBenchmarksSafety Alignment Evaluation on Safety Evaluation DatasetFollow81Response Safe Rate (Llama Guard Model)DCR64.3668.687377.32Feb 10, 2026Evaluation ResultsMethodMethodLinksResponse Safe Rate (Llama Guard Model)Response Safe Rate (OpenAI Moderation API)DCR2026.028192Surgical2026.027887STL-aug2026.027788STL2026.027286SCANS2026.026580