Predicting Language Model Output on HateBS
0.0043Brier ScoreLAMP
Evaluation Results
| Method | Links | |
|---|---|---|
| LAMPBase Language Model=Mistral Large2025.05 | 0.0043 | |
| LAMPBase Language Model=GPT-4.1-mini2025.05 | 0.0312 | |
| LAMPBase Language Model=Claude 3.5 Haiku2025.05 | 0.0497 | |
| LAMPBase Language Model=Gemini 2.5 Flash2025.05 | 0.072 | |
| SHAPBase Language Model=GPT-4.1-mini2025.05 | 0.0795 | |
| SHAPBase Language Model=Claude 3.5 Haiku2025.05 | 0.0815 | |
| ANCHORSBase Language Model=GPT-4.1-mini2025.05 | 0.0973 | |
| Mean baselineBase Language Model=GPT-4.1-mini2025.05 | 0.1201 | |
| LIMEBase Language Model=Claude 3.5 Haiku2025.05 | 0.1285 | |
| LIMEBase Language Model=Gemini 2.5 Flash2025.05 | 0.1489 | |
| SHAPBase Language Model=Gemini 2.5 Flash2025.05 | 0.1722 | |
| Uniform baselineBase Language Model=GPT-4.1-mini2025.05 | 0.1732 | |
| SHAPBase Language Model=Mistral Large2025.05 | 0.1732 | |
| Uniform baselineBase Language Model=Claude 3.5 Haiku2025.05 | 0.1917 | |
| LIMEBase Language Model=Mistral Large2025.05 | 0.1938 | |
| ANCHORSBase Language Model=Claude 3.5 Haiku2025.05 | 0.2043 | |
| Uniform baselineBase Language Model=Mistral Large2025.05 | 0.215 | |
| ANCHORSBase Language Model=Gemini 2.5 Flash2025.05 | 0.2189 | |
| Uniform baselineBase Language Model=Gemini 2.5 Flash2025.05 | 0.2303 | |
| ANCHORSBase Language Model=Mistral Large2025.05 | 0.2407 | |
| Random baselineBase Language Model=Claude 3.5 Haiku2025.05 | 0.2918 | |
| LIMEBase Language Model=GPT-4.1-mini2025.05 | 0.3051 | |
| Random baselineBase Language Model=GPT-4.1-mini2025.05 | 0.3409 | |
| Mean baselineBase Language Model=Claude 3.5 Haiku2025.05 | 0.3642 | |
| Random baselineBase Language Model=Mistral Large2025.05 | 0.413 | |
| Mean baselineBase Language Model=Mistral Large2025.05 | 0.4311 | |
| Random baselineBase Language Model=Gemini 2.5 Flash2025.05 | 0.4582 | |
| Mean baselineBase Language Model=Gemini 2.5 Flash2025.05 | 0.4807 |