Legal Reasoning on LegalArg
65.42AccuracyQwen3-4B-Instruct
Evaluation Results
| Method | Links | |
|---|---|---|
| Qwen3-4B-InstructModel Backbone=Qwen3-4B-Instruct, Finetuning Strategy=Continued Finetuning, SFT Data Source=Baseline2026.03 | 65.42 | |
| Qwen3-8B-Arguinas-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=Arguinas2026.03 | 62.87 | |
| Qwen3-4B-Instruct-Arguinas-SFTModel Backbone=Qwen3-4B-Instruct, Finetuning Strategy=Continued Finetuning, SFT Data Source=Arguinas2026.03 | 61.75 | |
| Qwen2.5-7B-Instruct-Arguinas-SFTModel Backbone=Qwen2.5-7B-Instruct, Finetuning Strategy=Continued Finetuning, SFT Data Source=Arguinas2026.03 | 61.67 | |
| Qwen3-8B-AAAC-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=AAAC2026.03 | 61.63 | |
| Qwen3-8B-EntailmentBank-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=EntailmentBank2026.03 | 61.24 | |
| Qwen2.5-7B-InstructModel Backbone=Qwen2.5-7B-Instruct, Finetuning Strategy=Continued Finetuning, SFT Data Source=Baseline2026.03 | 60.19 | |
| Qwen3-4B-Arguinas-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=Arguinas2026.03 | 58.52 | |
| Qwen3-8B-ArgumentOnly-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=ArgumentOnly2026.03 | 57.89 | |
| Qwen3-4B-AAAC-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=AAAC2026.03 | 56.06 | |
| Qwen3-4B-EntailmentBank-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=EntailmentBank2026.03 | 55.53 | |
| Qwen3-8B-Target-SFTModel Backbone=Qwen3-8B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=Target2026.03 | 54.7 | |
| Qwen3-4B-ArgumentOnly-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=ArgumentOnly2026.03 | 48.6 | |
| Qwen3-4B-Target-SFTModel Backbone=Qwen3-4B, Finetuning Strategy=Pre-adaptive Finetuning, SFT Data Source=Target2026.03 | 47.24 |