Fine-grained Hate Categorization on H-VLI (Normal)
88.64AccuracyGPT-5
Evaluation Results
| Method | Links | |
|---|---|---|
| GPT-5Training=False, Framework=ARCADE2026.03 | 88.64 | |
| GPT-4.1-miniTraining=False, Framework=ARCADE2026.03 | 82.99 | |
| MMBTTraining=True2026.03 | 80.28 | |
| BERT+ViTTraining=True2026.03 | 77.51 | |
| Qwen3-VL-PlusTraining=False, Framework=ARCADE2026.03 | 77.43 | |
| MomentaTraining=True2026.03 | 76.47 | |
| Gemini-2.5-FlashTraining=False, Framework=ARCADE2026.03 | 74.31 | |
| PromptHateTraining=True2026.03 | 73.36 | |
| GPT-4oTraining=False, Framework=ARCADE2026.03 | 73.26 | |
| Gemini-2.5-ProTraining=False, Framework=ARCADE2026.03 | 73.26 | |
| BERTTraining=True2026.03 | 72.66 | |
| GPT-5-miniTraining=False, Framework=ARCADE2026.03 | 70.83 | |
| ViT-b-16Training=True2026.03 | 68.86 | |
| Qwen-VL-MaxTraining=False, Framework=ARCADE2026.03 | 65.97 | |
| Qwen-VL-PlusTraining=False, Framework=ARCADE2026.03 | 61.46 | |
| GPT-5Training=False2026.03 | 55.56 | |
| Gemini-2.5-FlashTraining=False2026.03 | 55.02 | |
| Gemini-2.5-ProTraining=False2026.03 | 52.94 | |
| GPT-4oTraining=False2026.03 | 36.33 | |
| Qwen3-VL-PlusTraining=False2026.03 | 34.26 | |
| GPT-5-miniTraining=False2026.03 | 29.76 | |
| GPT-4.1-miniTraining=False2026.03 | 28.72 | |
| Qwen-VL-PlusTraining=False2026.03 | 10.03 | |
| Qwen-VL-MaxTraining=False2026.03 | 9.34 |