Image Classification on Food
95.3AccuracyDom-Ad (Am-B)
Evaluation Results
| Method | Links | |||
|---|---|---|---|---|
| Dom-Ad (Am-B)Backbone Architecture=AmoebaNet-B2020.09 | 95.3 | — | — | |
| Dom-Ad (In-v3)Backbone Architecture=Inception-v32020.09 | 94.1 | — | — | |
| KNNSelection Method=KNN, Adaptation Strategy=Full, Training Epochs=4e, Backbone Architecture=Resnet-50-v22020.09 | 93.1 | — | — | |
| KLSelection Method=KL, Adaptation Strategy=Full, Training Epochs=4e, Backbone Architecture=Resnet-50-v22020.09 | 93.1 | — | — | |
| KNNSelection Method=KNN, Adaptation Strategy=Full, Training Epochs=2e, Backbone Architecture=Resnet-50-v22020.09 | 92.9 | — | — | |
| KLSelection Method=KL, Adaptation Strategy=Full, Training Epochs=2e, Backbone Architecture=Resnet-50-v22020.09 | 92.9 | — | — | |
| OpenAI-CLIP ViT-LN=400M, Zero-shot=true2024.09 | 92.9 | — | — | |
| OpenAI-CLIP VIT-LN=400M, Zero-shot=true2024.09 | 92.9 | — | — | |
| EPNSelection Method=EPN, Adaptation Strategy=Full, Training Epochs=2e, Backbone Architecture=Resnet-50-v22020.09 | 92.5 | — | — | |
| EPNSelection Method=EPN, Adaptation Strategy=Full, Training Epochs=4e, Backbone Architecture=Resnet-50-v22020.09 | 92.4 | — | — | |
| OriginalBackbone=ViT-L/14, Step=Step 02026.05 | 92.05 | — | — | |
| FTBackbone=ViT-L/14, Step=Step 12026.05 | 91.72 | — | — | |
| KNNSelection Method=KNN, Adaptation Strategy=Adapters, Training Epochs=4e, Backbone Architecture=Resnet-50-v22020.09 | 91.6 | — | — | |
| KLSelection Method=KL, Adaptation Strategy=Adapters, Training Epochs=4e, Backbone Architecture=Resnet-50-v22020.09 | 91.6 | — | — | |
| EPNSelection Method=EPN, Adaptation Strategy=Adapters, Training Epochs=4e, Backbone Architecture=Resnet-50-v22020.09 | 91.5 | — | — | |
| GABackbone=ViT-L/14, Step=Step 12026.05 | 91.5 | — | — | |
| X+OS_SimCoreCriterion=Stopping Criterion2023.03 | 91.31 | — | — | |
| BaselineBackbone Architecture=Resnet-50-v22020.09 | 91.3 | — | — | |
| CATABackbone=ViT-L/14, Step=Step 22026.05 | 91.23 | — | — | |
| CATABackbone=ViT-L/14, Step=Step 12026.05 | 91.22 | — | — | |
| CATABackbone=ViT-L/14, Step=Step 32026.05 | 91.13 | — | — | |
| CATABackbone=ViT-L/14, Step=Step 52026.05 | 91.11 | — | — | |
| CATABackbone=ViT-L/14, Step=Step 42026.05 | 90.99 | — | — | |
| FTBackbone=ViT-L/14, Step=Step 32026.05 | 90.52 | — | — | |
| FTBackbone=ViT-L/14, Step=Step 22026.05 | 90.36 | — | — | |
| FTBackbone=ViT-L/14, Step=Step 42026.05 | 90.08 | — | — | |
| LAION-CLIP ViT-LN=400M, Zero-shot=true2024.09 | 90 | — | — | |
| LAION-CLIP VIT-LN=400M, Zero-shot=true2024.09 | 90 | — | — | |
| TWISTEvaluation Protocol=Fine-tune, Backbone=ResNet-50, Pre-trained=ImageNet2021.10 | 89.3 | — | — | |
| FTBackbone=ViT-L/14, Step=Step 52026.05 | 89.23 | — | — | |
| DINOv2-ARLN=20M, Zero-shot=true2024.09 | 89.1 | — | — | |
| DINOv2-ARLN=20M, Zero-shot=true2024.09 | 89.1 | — | — | |
| GABackbone=ViT-L/14, Step=Step 22026.05 | 88.91 | — | — | |
| BYOLEvaluation Protocol=Fine-tune, Backbone=ResNet-50, Pre-trained=ImageNet2021.10 | 88.5 | — | — | |
| BYOLEvaluation Protocol=Fine-tuned, Backbone=ResNet, Pre-training Dataset=ImageNet2020.11 | 88.5 | — | — | |
| SUPEvaluation Protocol=Fine-tune, Backbone=ResNet-50, Pre-trained=ImageNet2021.10 | 88.3 | — | — | |
| FNCEvaluation Protocol=Fine-tuned, Backbone=ResNet, Pre-training Dataset=ImageNet2020.11 | 88.3 | — | — | |
| SimCLR v1Evaluation Protocol=Fine-tuned, Backbone=ResNet, Pre-training Dataset=ImageNet2020.11 | 88.2 | — | — | |
| SimCLR v2Evaluation Protocol=Fine-tuned, Backbone=ResNet, Pre-training Dataset=ImageNet2020.11 | 88.2 | — | — | |
| InMaPBackbone=ViT-B/16, Evaluation Protocol=Transductive Zero-Shot2024.04 | 88 | — | — | |
| X2023.03 | 87.99 | — | — | |
| InMaP + ZLaPBackbone=ViT-B/16, Evaluation Protocol=Transductive Zero-Shot2024.04 | 87.9 | — | -0.1 | |
| TransCLIP-FSShots=1, Backbone=ViT-B/162024.06 | 87.9 | — | — | |
| SimCLREvaluation Protocol=Fine-tune, Backbone=ResNet-50, Pre-trained=ImageNet2021.10 | 87.5 | — | — | |
| DINOv2-MpNetN=20M, Zero-shot=true2024.09 | 87.5 | — | — | |
| DINOv2-MpNetN=20M, Zero-shot=true2024.09 | 87.5 | — | — | |
| CLIP + ZLaPBackbone=ViT-B/16, Evaluation Protocol=Transductive Zero-Shot2024.04 | 87.2 | — | 1.5 | |
| RandomEvaluation Protocol=Fine-tune, Backbone=ResNet-50, Pre-trained=ImageNet2021.10 | 86.9 | — | — | |
| TransCLIP-FSShots=16, Backbone=ViT-B/162024.06 | 86.9 | — | — | |
| TransCLIP-FSShots=4, Backbone=ViT-B/162024.06 | 86.4 | — | — | |
| CLIP-DNBackbone=ViT-B/16, Evaluation Protocol=Transductive Zero-Shot2024.04 | 86 | — | — | |
| CLIP-ViT-B/16Shots=0, Backbone=ViT-B/162024.06 | 85.9 | — | — | |
| CLIPBackbone=ViT-B/16, Evaluation Protocol=Transductive Zero-Shot2024.04 | 85.7 | — | — | |
| TPTBackbone=ViT-B/16, Evaluation Protocol=Transductive Zero-Shot2024.04 | 84.7 | — | — | |
| REACTEvaluation Protocol=Retrieval Augmented, Retrieval Size=10K, Variant=Gated-Image2024.01 | 83 | — | — | |
| FTBackbone=ViT-B/32, Step=Step 12026.05 | 82.17 | — | — | |
| OriginalBackbone=ViT-B/32, Step=Step 02026.05 | 82.05 | — | — | |
| REACTEvaluation Protocol=Retrieval Augmented, Retrieval Size=10K, Variant=Locked-Text2024.01 | 81.8 | — | — | |
| GABackbone=ViT-B/32, Step=Step 12026.05 | 81.8 | — | — | |
| REAL-LinearEvaluation Protocol=Retrieval Augmented, Retrieval Size=5002024.01 | 81.4 | — | — | |
| FTBackbone=ViT-B/32, Step=Step 22026.05 | 81.22 | — | — | |
| LiT L16LN=112M, Zero-shot=true2024.09 | 81.1 | — | — | |
| LiT L16LN=112M, Zero-shot=true2024.09 | 81.1 | — | — | |
| OriginalBackbone=RN1012026.05 | 81.1 | — | — | |
| REAL-PromptEvaluation Protocol=Zero-Shot Prompting2024.01 | 81 | — | — | |
| OpenAI templatesEvaluation Protocol=Zero-Shot Prompting2024.01 | 80.9 | — | — | |
| PromptingEvaluation Protocol=Zero-Shot Prompting, Prompt Template=a photo of {concept}2024.01 | 80.3 | — | — | |
| PromptingEvaluation Protocol=Zero-Shot Prompting, Prompt Template={concept}2024.01 | 80.1 | — | — | |
| DCLIPEvaluation Protocol=Zero-Shot Prompting2024.01 | 80.1 | — | — | |
| FTBackbone=ViT-B/32, Step=Step 32026.05 | 79.93 | — | — | |
| CuPLEvaluation Protocol=Zero-Shot Prompting2024.01 | 79.5 | — | — | |
| InMaPBackbone=ResNet-50, Evaluation Protocol=Transductive Zero-Shot2024.04 | 79.4 | — | — | |
| GABackbone=ViT-B/32, Step=Step 22026.05 | 79.3 | — | — | |
| InMaP + ZLaPBackbone=ResNet-50, Evaluation Protocol=Transductive Zero-Shot2024.04 | 79.2 | — | -0.2 | |
| CLIP-LIPBackbone=RN1012026.05 | 79.11 | — | — | |
| CATABackbone=RN1012026.05 | 78.97 | — | — | |
| CLIP + ZLaPBackbone=ResNet-50, Evaluation Protocol=Transductive Zero-Shot2024.04 | 78.8 | — | 2.2 | |
| FTBackbone=ViT-B/32, Step=Step 42026.05 | 78.72 | — | — | |
| CATABackbone=ViT-B/32, Step=Step 22026.05 | 78.42 | — | — | |
| CATABackbone=ViT-B/32, Step=Step 12026.05 | 78.18 | — | — | |
| CATABackbone=ViT-B/32, Step=Step 32026.05 | 78.06 | — | — | |
| CATABackbone=ViT-B/32, Step=Step 42026.05 | 78.04 | — | — | |
| FTBackbone=ViT-B/32, Step=Step 52026.05 | 78.02 | — | — | |
| TWISTEvaluation Protocol=Linear evaluation, Backbone=ResNet-50, Pre-trained=ImageNet2021.10 | 78 | — | — | |
| CLIP-DNBackbone=ResNet-50, Evaluation Protocol=Transductive Zero-Shot2024.04 | 77.2 | — | — | |
| CATABackbone=ViT-B/32, Step=Step 52026.05 | 77.2 | — | — | |
| GABackbone=ViT-B/32, Step=Step 32026.05 | 77 | — | — | |
| CLIP-LIPBackbone=RN502026.05 | 76.78 | — | — | |
| CLIPBackbone=ResNet-50, Evaluation Protocol=Transductive Zero-Shot2024.04 | 76.6 | — | — | |
| OriginalBackbone=RN502026.05 | 76.49 | — | — | |
| BYOLEvaluation Protocol=Linear evaluation, Backbone=ResNet-50, Pre-trained=ImageNet2021.10 | 75.3 | — | — | |
| BYOLEvaluation Protocol=Linear eval, Backbone=ResNet, Pre-training Dataset=ImageNet2020.11 | 75.3 | — | — | |
| TPTBackbone=ResNet-50, Evaluation Protocol=Transductive Zero-Shot2024.04 | 74.9 | — | — | |
| GABackbone=ViT-B/32, Step=Step 42026.05 | 74.47 | — | — | |
| CATABackbone=RN502026.05 | 74.43 | — | — | |
| FNCEvaluation Protocol=Linear eval, Backbone=ResNet, Pre-training Dataset=ImageNet2020.11 | 74.4 | — | — | |
| SimCLR v2Evaluation Protocol=Linear eval, Backbone=ResNet, Pre-training Dataset=ImageNet2020.11 | 73.9 | — | — | |
| SUPEvaluation Protocol=Linear evaluation, Backbone=ResNet-50, Pre-trained=ImageNet2021.10 | 72.3 | — | — | |
| SimSiam + AugSelfFine-tuning strategy=L2SP, Pre-trained on=ImageNet100, Backbone=ResNet-502021.11 | 70.19 | — | — | |
| GABackbone=ViT-B/32, Step=Step 52026.05 | 70.1 | — | — |