Compositional Multi-tasking on Compositional Summation and Translation (test)
28.64R-L Score (%)Learnable Calibration++
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| Learnable Calibration++Efficient?=true2025.07 | 28.64 | 65.15 | |
| Learnable CalibrationEfficient?=true2025.07 | 25.4 | 59.23 | |
| Joint-expert LoRAEfficient?=false2025.07 | 21.36 | 49.85 | |
| Multi-step LoRA usageEfficient?=false2025.07 | 21.25 | 72.92 | |
| Shared Learnable Calibration++Efficient?=true2025.07 | 19.23 | 32.61 | |
| Shared Learnable CalibrationEfficient?=true2025.07 | 17.04 | 29.91 | |
| DAM/ZipLoRA mergeEfficient?=true2025.07 | 16.19 | 17.16 | |
| In-context learningEfficient?=true2025.07 | 14.46 | 10.95 | |
| Concat mergeEfficient?=true2025.07 | 14.39 | 0.34 | |
| Linear mergeEfficient?=true2025.07 | 14.27 | 0.33 | |
| Auxiliary-task LoRAEfficient?=true2025.07 | 13.99 | 0.3 | |
| Slerp mergeEfficient?=true2025.07 | 13.96 | 0.54 | |
| LoraHub mergeEfficient?=true2025.07 | 13.78 | 1.59 | |
| LM-Cocktail mergeEfficient?=true2025.07 | 13.62 | 0.7 | |
| Main-task LoRAEfficient?=true2025.07 | 13.39 | 3.49 | |
| TIES mergeEfficient?=true2025.07 | 12.25 | 0.81 | |
| DARE mergeEfficient?=true2025.07 | 9.27 | 0.68 | |
| Zero-shotEfficient?=true2025.07 | 7.49 | 0.44 |