Prompt Hijacking on IHEval Prompt Hijacking Conflict 1.0
45AccuracyQwen3-4B-it-NSHA-SFT
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen3-4B-it-NSHA-SFTBackbone=Qwen3-4B, Methodology=NSHA-SFT2026.04 | 45 | |
| Llama3.1-8B-NSHA-DPOBackbone=Llama3.1-8B, Methodology=NSHA-DPO2026.04 | 30.6 | |
| Llama3.1-8B-NSHA-SFTBackbone=Llama3.1-8B, Methodology=NSHA-SFT2026.04 | 27.5 | |
| Llama3.1-8B-NSHA-HCALBackbone=Llama3.1-8B, Methodology=NSHA-HCAL2026.04 | 20.1 | |
| Llama3.1-8B-NSBackbone=Llama3.1-8B, Methodology=Neuro-Symbolic2026.04 | 19.7 | |
| Llama3.1-8BBackbone=Llama3.1-8B, Methodology=Instruct2026.04 | 19.3 | |
| Llama3.1-8B-CoTBackbone=Llama3.1-8B, Methodology=Chain-of-Thought2026.04 | 17 | |
| Qwen3-4B-it-NSBackbone=Qwen3-4B, Methodology=Neuro-Symbolic2026.04 | 13.8 | |
| Qwen3-4B-itBackbone=Qwen3-4B, Methodology=Instruct2026.04 | 13.1 | |
| Qwen3-4B-it-NSHA-HCALBackbone=Qwen3-4B, Methodology=NSHA-HCAL2026.04 | 12.5 | |
| Qwen3-4B-it-NSHA-DPOBackbone=Qwen3-4B, Methodology=NSHA-DPO2026.04 | 9.8 | |
| Qwen3-4B-it-CoTBackbone=Qwen3-4B, Methodology=Chain-of-Thought2026.04 | 8.5 |