Bias Evaluation on Reddit Bias
-4.7523t-valueLlama 3.1 8B - Pretrained model (baseline 1)
Evaluation Results
| Method | Links | |
|---|---|---|
| Llama 3.1 8B - Pretrained model (baseline 1)Model=Llama 3.1 8B, Variant=Pretrained model (baseline 1)2025.12 | -4.7523 | |
| Llama 3.1 8B - LFT w. SH-Dgender (GC-CDA)Model=Llama 3.1 8B, Variant=LFT w. SH-Dgender (GC-CDA)2025.12 | -1.5541 | |
| Qwen 3 0.6B - LFT w. SH-Dgender (GC-CDA)Model=Qwen 3 0.6B, Variant=LFT w. SH-Dgender (GC-CDA)2025.12 | -1.5202 | |
| Llama 3.1 8B - LFT w. SH-N (baseline 3)Model=Llama 3.1 8B, Variant=LFT w. SH-N (baseline 3)2025.12 | -1.4717 | |
| Qwen 3 0.6B - LFT w. SH-Dgender(BaseCDA)Model=Qwen 3 0.6B, Variant=LFT w. SH-Dgender(BaseCDA)2025.12 | -1.4295 | |
| Qwen 3 0.6B - Pretrained model (baseline 1)Model=Qwen 3 0.6B, Variant=Pretrained model (baseline 1)2025.12 | -1.423 | |
| Llama 3.1 8B - LFT w. SH-Dgender (BaseCDA)Model=Llama 3.1 8B, Variant=LFT w. SH-Dgender (BaseCDA)2025.12 | -1.414 | |
| Llama 3.2 1B - Pretrained model (baseline 1)Model=Llama 3.2 1B, Variant=Pretrained model (baseline 1)2025.12 | -1.2381 | |
| Llama 3.2 1B - LFT w. SH-Dgender (BaseCDA)Model=Llama 3.2 1B, Variant=LFT w. SH-Dgender (BaseCDA)2025.12 | -1.1952 | |
| Qwen 3 0.6B - LFT w. SH (baseline 2)Model=Qwen 3 0.6B, Variant=LFT w. SH (baseline 2)2025.12 | -1.1726 | |
| Llama 3.1 8B - LFT w. SH (baseline 2)Model=Llama 3.1 8B, Variant=LFT w. SH (baseline 2)2025.12 | -1.1604 | |
| Llama 3.2 1B - LFT w. SH-Dgender (GC-CDA)Model=Llama 3.2 1B, Variant=LFT w. SH-Dgender (GC-CDA)2025.12 | -1.0759 | |
| Qwen 3 0.6B - LFT w. SH-N (baseline 3)Model=Qwen 3 0.6B, Variant=LFT w. SH-N (baseline 3)2025.12 | -1.0025 | |
| Llama 3.2 1B - LFT w. SH-N (baseline 3)Model=Llama 3.2 1B, Variant=LFT w. SH-N (baseline 3)2025.12 | -0.9925 | |
| Llama 3.2 1B - LFT w. SH (baseline 2)Model=Llama 3.2 1B, Variant=LFT w. SH (baseline 2)2025.12 | -0.7951 |