Binary Hate Detection on H-VLI (Hard)
79.39AccuracyGemini-2.5-Pro
Evaluation Results
| Method | Links | |
|---|---|---|
| Gemini-2.5-ProTraining=False, Framework=ARCADE2026.03 | 79.39 | |
| GPT-4oTraining=False, Framework=ARCADE2026.03 | 78.79 | |
| Gemini-2.5-ProTraining=False2026.03 | 78.11 | |
| Gemini-2.5-FlashTraining=False, Framework=ARCADE2026.03 | 75.15 | |
| Gemini-2.5-FlashTraining=False2026.03 | 69.23 | |
| GPT-5Training=False, Framework=ARCADE2026.03 | 69.13 | |
| GPT-4.1-miniTraining=False, Framework=ARCADE2026.03 | 66.06 | |
| GPT-4.1-miniTraining=False2026.03 | 63.91 | |
| GPT-5-miniTraining=False, Framework=ARCADE2026.03 | 61.82 | |
| GPT-4oTraining=False2026.03 | 61.54 | |
| ViT-b-16Training=True2026.03 | 55.62 | |
| Qwen3-VL-PlusTraining=False, Framework=ARCADE2026.03 | 51.52 | |
| Qwen-VL-MaxTraining=False2026.03 | 45.45 | |
| BERTTraining=True2026.03 | 39.64 | |
| Qwen-VL-MaxTraining=False, Framework=ARCADE2026.03 | 38.79 | |
| BERT+ViTTraining=True2026.03 | 38.46 | |
| PromptHateTraining=True2026.03 | 37.87 | |
| MMBTTraining=True2026.03 | 36.69 | |
| MomentaTraining=True2026.03 | 33.14 | |
| Qwen3-VL-PlusTraining=False2026.03 | 31.52 | |
| Qwen-VL-PlusTraining=False, Framework=ARCADE2026.03 | 29.88 | |
| GPT-5Training=False2026.03 | 24.79 | |
| Qwen-VL-PlusTraining=False2026.03 | 14.55 | |
| GPT-5-miniTraining=False2026.03 | 12.43 |