Argument Quality Evaluation on UKPConvArg 2
92.86AccuracyQwen3-8B-Arguinas-Target-SFT
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen3-8B-Arguinas-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=Arguinas2026.03 | 92.86 | |
| Qwen3-4B-Arguinas-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=Arguinas2026.03 | 92.79 | |
| Qwen3-4B-AAAC-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=AAAC2026.03 | 92.74 | |
| Qwen3-8B-ArgumentOnly-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=ArgumentOnly2026.03 | 92.56 | |
| Qwen3-4B-EntailmentBank-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=EntailmentBank2026.03 | 92.49 | |
| Qwen3-8B-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=Target2026.03 | 92.49 | |
| Qwen3-4B-ArgumentOnly-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=ArgumentOnly2026.03 | 92.45 | |
| Qwen3-4B-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=Target2026.03 | 92.35 | |
| Qwen3-8B-AAAC-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=AAAC2026.03 | 92.12 | |
| Qwen3-8B-EntailmentBank-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=EntailmentBank2026.03 | 91.4 | |
| Qwen3-4B-Instruct-Arguinas-SFTModel Backbone=Qwen3-4B-Instruct, Finetuning Strategy=Continued Finetuning, SFT Data Source=Arguinas2026.03 | 80.22 | |
| Qwen3-4B-InstructModel Backbone=Qwen3-4B-Instruct, Finetuning Strategy=Continued Finetuning, SFT Data Source=Baseline2026.03 | 77.66 | |
| Qwen2.5-7B-Instruct-Arguinas-SFTModel Backbone=Qwen2.5-7B-Instruct, Finetuning Strategy=Continued Finetuning, SFT Data Source=Arguinas2026.03 | 77.59 | |
| Qwen2.5-7B-InstructModel Backbone=Qwen2.5-7B-Instruct, Finetuning Strategy=Continued Finetuning, SFT Data Source=Baseline2026.03 | 77.45 |