Image Classification on Stanford Cars (val)
94.5AccuracyDeiT III-L
Evaluation Results
| Method | Links | |
|---|---|---|
| DeiT III-LBackbone=ViT-L, Pre-training=ImageNet-1k, Epochs=400, Resolution=224x224, Crop ratio=1.02022.04 | 94.5 | |
| DeiT III-BBackbone=ViT-B, Pre-training=ImageNet-1k, Epochs=400, Resolution=224x224, Crop ratio=1.02022.04 | 93.4 | |
| CPGBackbone=ResNet-50, Model Size (MB)=1212019.10 | 92.8 | |
| SigLIxPTrain-free=true, Shots=16, Backbone=ViT-B/162024.11 | 92.8 | |
| Grafit ResNet-50 [52]Pre-training=ImageNet-1k, Crop ratio=0.8752022.04 | 92.5 | |
| DeiT-BPre-training=ImageNet-1k, Crop ratio=0.8752022.04 | 92.1 | |
| FinetuneBackbone=ResNet-50, Model Size (MB)=5542019.10 | 91.83 | |
| DeiT III-SBackbone=ViT-S, Pre-training=ImageNet-1k, Epochs=400, Resolution=224x224, Crop ratio=1.02022.04 | 89.9 | |
| PiggybackBackbone=ResNet-50, Model Size (MB)=1212019.10 | 89.62 | |
| ProgressiveNetBackbone=ResNet-50, Model Size (MB)=5632019.10 | 89.21 | |
| MentorMixtraining_setting=Fine-tuned, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 86.9 | |
| CasPLTrain-free=false, Shots=16, Backbone=ViT-B/162024.11 | 86.7 | |
| PackNetBackbone=ResNet-50, Model Size (MB)=1152019.10 | 86.11 | |
| DMNTrain-free=false, Shots=16, Backbone=ViT-B/162024.11 | 85.3 | |
| Mixuptraining_setting=Fine-tuned, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 85 | |
| WeightDecaytraining_setting=Fine-tuned, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 84.3 | |
| Dropouttraining_setting=Trained from scratch, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 84.1 | |
| Dropouttraining_setting=Fine-tuned, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 83.8 | |
| PromptSRCTrain-free=false, Shots=16, Backbone=ViT-B/162024.11 | 83.8 | |
| MentorMixtraining_setting=Trained from scratch, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 83.6 | |
| MaPLeTrain-free=false, Shots=16, Backbone=ViT-B/162024.11 | 83.6 | |
| Bootstraptraining_setting=Fine-tuned, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 82.8 | |
| MentorNettraining_setting=Fine-tuned, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 82.6 | |
| Mixuptraining_setting=Trained from scratch, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 82.5 | |
| Vanillatraining_setting=Fine-tuned, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 82.4 | |
| S-Modeltraining_setting=Fine-tuned, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 82.4 | |
| Linear ProbeTrain-free=false, Shots=16, Backbone=ViT-B/162024.11 | 80.4 | |
| Bootstraptraining_setting=Trained from scratch, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 78.9 | |
| MentorNettraining_setting=Trained from scratch, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 78.9 | |
| DMN-TFTrain-free=true, Shots=16, Backbone=ViT-B/162024.11 | 78.4 | |
| MentorMixtraining_setting=Fine-tuned, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 78.2 | |
| Vanillatraining_setting=Trained from scratch, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 77.7 | |
| S-Modeltraining_setting=Trained from scratch, noise_type=Red, backbone=Inception-ResNet-v22019.11 | 77.6 | |
| MentorNettraining_setting=Fine-tuned, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 75.9 | |
| Mixuptraining_setting=Fine-tuned, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 73.1 | |
| WeightDecaytraining_setting=Fine-tuned, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 72.2 | |
| Dropouttraining_setting=Fine-tuned, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 71.7 | |
| Bootstraptraining_setting=Fine-tuned, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 71.7 | |
| Vanillatraining_setting=Fine-tuned, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 70 | |
| S-Modeltraining_setting=Fine-tuned, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 69.7 | |
| MentorMixtraining_setting=Trained from scratch, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 67.7 | |
| OTTEREvaluation Protocol=Linear Probing, Label Distribution Estimation=BBSE+OT2024.04 | 66.3 | |
| BBSE+PMEvaluation Protocol=Linear Probing, Label Distribution Estimation=BBSE+PM2024.04 | 65.4 | |
| Linear Probing baselineEvaluation Protocol=Linear Probing, Label Distribution Estimation=None2024.04 | 64.5 | |
| Mixuptraining_setting=Trained from scratch, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 64.2 | |
| Dropouttraining_setting=Trained from scratch, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 62.8 | |
| Train from ScratchBackbone=ResNet-50, Model Size (MB)=5542019.10 | 61.56 | |
| Reference Masking RegularizationBackbone=ViTb16, Pre-trained=ImageNet-1K, Adaptation Protocol=Linear Probing2024.06 | 61.15 | |
| StandardBackbone=ViTb16, Pre-trained=ImageNet-1K, Adaptation Protocol=Linear Probing2024.06 | 58.54 | |
| MentorNettraining_setting=Trained from scratch, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 56.8 | |
| Zero-Shot baselineEvaluation Protocol=Zero-Shot, Label Distribution Estimation=None2024.04 | 55.7 | |
| Bootstraptraining_setting=Trained from scratch, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 55.6 | |
| S-Modeltraining_setting=Trained from scratch, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 53.9 | |
| Vanillatraining_setting=Trained from scratch, noise_type=Blue, backbone=Inception-ResNet-v22019.11 | 53.8 | |
| OTTEREvaluation Protocol=Zero-Shot, Label Distribution Estimation=BBSE+OT2024.04 | 51.7 | |
| ITO_sub3Pre-training Dataset=CC3M-recap, Backbone=ViT-B/16, Evaluation Protocol=Linear Probing2026.03 | 25.32 | |
| FLAIRPre-training Dataset=CC3M-recap, Backbone=ViT-B/16, Evaluation Protocol=Linear Probing2026.03 | 25.05 | |
| ITO_sub2Pre-training Dataset=CC3M-recap, Backbone=ViT-B/16, Evaluation Protocol=Linear Probing2026.03 | 23.96 | |
| BBSE+PMEvaluation Protocol=Zero-Shot, Label Distribution Estimation=BBSE+PM2024.04 | 2.3 |