Class-Incremental Learning on VTAB
96.7Avg AccuracySoTU
Evaluation Results
| Method | Links | ||||
|---|---|---|---|---|---|
| SoTUBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | 96.7 | — | — | 93.4 | |
| RanPACBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | 95.3 | — | — | 92.2 | |
| StaR-MoEBackbone=ViT-B/16-IN1K2026.05 | 94.43 | 93.79 | — | — | |
| DERBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=10, Examples per class=202024.11 | 93.1 | — | — | 89.8 | |
| RanPACalgorithm=Algorithm 12023.07 | 92.6 | — | — | — | |
| CoOp + OursBackbone=ViT-B/162024.03 | 92.51 | 91.28 | — | — | |
| Joint full fine-tuningstrategy=full fine-tuning, backbone=ViT2023.07 | 92 | — | — | — | |
| SEMABackbone=ViT-B/16-IN21K2024.03 | 91.99 | — | — | 90.86 | |
| ADAM (SSF)Backbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=10, variant=SSF2024.11 | 91.6 | — | — | 84.3 | |
| OursBackbone=ViT-B/162024.03 | 91.37 | 89.67 | — | — | |
| SEMA2024.03 | 91.26 | 89.64 | — | — | |
| SEMABackbone=ViT-B/16-IN1K2024.03 | 91.26 | — | — | 89.64 | |
| MaPLe + OursBackbone=ViT-B/162024.03 | 90.97 | 88.83 | — | — | |
| SEMABackbone=ViT-B/16-IN1K2026.05 | 90.93 | 88.12 | — | — | |
| SimpleCILBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | 90.9 | — | — | 83.6 | |
| ADAM (Ada)Backbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=10, variant=Ada2024.11 | 90.9 | — | — | 83.6 | |
| Ours w/o VIBackbone=ViT-B/162024.03 | 90.74 | 88.64 | — | — | |
| SD-LoRABackbone=ViT-B/16-IN1K2026.05 | 90 | 87.61 | — | — | |
| InfLORABackbone=ViT-B/16-IN21K2024.03 | 89.61 | — | — | 86.52 | |
| InfLoRABackbone=ViT-B/16-IN1K2024.03 | 88.9 | — | — | 87.63 | |
| CODA-PromptBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | 88.6 | — | — | 89.3 | |
| InfLoRABackbone=ViT-B/16-IN1K2026.05 | 88.43 | 88.54 | — | — | |
| DualPromptBackbone=ViT-B/16-IN21K2024.03 | 88.11 | — | — | 77.58 | |
| FOSTERBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=10, Examples per class=202024.11 | 87.9 | — | — | 80.2 | |
| CODA-PBackbone=ViT-B/162024.03 | 87.5 | 81.2 | — | — | |
| CoOpBackbone=ViT-B/162024.03 | 87.06 | 81.25 | — | — | |
| APER + SSFBackbone=ViT-B/16-IN1K2026.05 | 86.75 | 84.51 | — | — | |
| DualPromptBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | 86.2 | — | — | 73.6 | |
| CODA-PromptBackbone=ViT-B/16-IN1K2026.05 | 86.16 | 86.34 | — | — | |
| SimpleCILBackbone=ViT-B/16-IN21K2024.03 | 85.99 | — | — | 84.38 | |
| ADAMBackbone=ViT-B/16-IN21K2024.03 | 85.95 | — | — | 84.35 | |
| ESNBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | 85.9 | — | — | 85.2 | |
| SimpleCILBackbone=ViT-B/16-IN1K2026.05 | 85.42 | 83.61 | — | — | |
| APER + AdapterBackbone=ViT-B/16-IN1K2026.05 | 85.42 | 83.59 | — | — | |
| SimpleCILBackbone=ViT-B/16-IN1K2024.03 | 85.29 | — | — | 83.61 | |
| ADAMBackbone=ViT-B/16-IN1K2024.03 | 85.29 | — | — | 83.61 | |
| CODA-PBackbone=ViT-B/16-IN21K2024.03 | 85.13 | — | — | 85.85 | |
| HiDe-PromptBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | 84.8 | — | — | 84.6 | |
| MaPLeBackbone=ViT-B/162024.03 | 83.91 | 81.81 | — | — | |
| L2PBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | 83.4 | — | — | 61.7 | |
| DualPromptBackbone=ViT-B/16-IN1K2024.03 | 82.89 | — | — | 79.79 | |
| DualPromptBackbone=ViT-B/16-IN1K2026.05 | 82.89 | 79.79 | — | — | |
| MEMOBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=10, Examples per class=202024.11 | 81.5 | — | — | 86.9 | |
| L2PBackbone=ViT-B/16-IN1K2024.03 | 81.19 | — | — | 80.83 | |
| L2PBackbone=ViT-B/16-IN1K2026.05 | 81.19 | 80.83 | — | — | |
| CODA-PBackbone=ViT-B/16-IN1K2024.03 | 79.88 | — | — | 81.58 | |
| L2PBackbone=ViT-B/16-IN21K2024.03 | 79.17 | — | — | 63.56 | |
| AttriCLIP + OursBackbone=ViT-B/162024.03 | 74.84 | 71.12 | — | — | |
| iCaRLBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=10, Examples per class=202024.11 | 74 | — | — | 85.9 | |
| AttriCLIPBackbone=ViT-B/162024.03 | 71.84 | 64.09 | — | — | |
| Continual-CLIPBackbone=ViT-B/162024.03 | 68.5 | 60.97 | — | — | |
| CLIP-AdapterBackbone=ViT-B/162024.03 | 68.23 | 61.02 | — | — | |
| VPTBackbone=ViT-B/162024.03 | 67.2 | 57.26 | — | — | |
| FT AdapterBackbone=ViT-B/16-IN1K2024.03 | 59.98 | — | — | 43.5 | |
| iCaRLBackbone=ViT-B/162024.03 | 53.38 | 41.6 | — | — | |
| Adam-AdaptBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 83.6 | — | |
| Adam-AdaptBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 84.4 | — | |
| Adam-FTBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 83.8 | — | |
| Adam-FTBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 84.4 | — | |
| Adam-SSFBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 84.2 | — | |
| Adam-SSFBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 84.9 | — | |
| Adam-VPTBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 86.9 | — | |
| Adam-VPTBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 81.1 | — | |
| CODA-PromptBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 6.3 | — | |
| DualPromptBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 4.2 | — | |
| FinetuneBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 2.1 | — | |
| FinetuneBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 0.5 | — | |
| Joint full tuningBackbone=ViT-B/16, Pre-training=ImageNet21K, Tasks=102024.11 | — | — | — | 92 | |
| L2PBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 1.3 | — | |
| NCMBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 88.2 | — | |
| NCMBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 88.5 | — | |
| RanDumbBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 93.6 | — | |
| RanDumbBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 92.4 | — | |
| RanPACBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 93 | — | |
| RanPACBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 88.2 | — | |
| RanPAC-impBackbone=ViT-B/16, Pre-training=ImageNet-1K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 93 | — | |
| RanPAC-impBackbone=ViT-B/16, Pre-training=ImageNet-21K, Task Setting=2 init classes, 1 class per task2024.02 | — | — | 91.9 | — |