Weakly Supervised Semantic Segmentation on PASCAL VOC 2012 (test)
74.9mIoUOurs (PPC-based)
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| Ours (PPC-based)Supervision=I+S, Backbone=ResNet1012024.06 | 74.9 | — | |
| SeCoType=single-staged, Backbone=ViT-B/162024.02 | 73.8 | — | |
| PPCSupervision=I+S, Backbone=ResNet1012024.06 | 73.6 | — | |
| SBCESupervision=I+S, Backbone=ResNet1012024.06 | 73.4 | — | |
| Ours (AMN-based)Supervision=I, Backbone=ResNet1012024.06 | 73.2 | — | |
| RCASupervision=I+S, Backbone=ResNet382024.06 | 72.8 | — | |
| ACRSupervision=I, Backbone=ResNet382024.06 | 72.4 | — | |
| ToCoType=single-staged, Backbone=ViT-B/162024.02 | 72.2 | — | |
| TOCOSupervision=I, Backbone=VIT-B2024.06 | 72.2 | — | |
| RECAMSupervision=I+S, Backbone=ResNet1012024.06 | 72.2 | — | |
| NSROM + ADELESupervision=Image-level labels + External saliency models, Backbone=ResNet-382021.10 | 72 | — | |
| OCRType=multi-staged, Backbone=ResNet382024.02 | 72 | — | |
| BECOSupervision=I, Backbone=ResNet382024.06 | 71.8 | — | |
| L2GType=multi-staged, Backbone=ResNet1012024.02 | 71.7 | — | |
| AEFTSupervision=I, Backbone=ResNet382024.06 | 71.7 | — | |
| L2GSupervision=I+S, Backbone=ResNet1012024.06 | 71.7 | — | |
| MCTSupervision=I+S, Backbone=ResNet382024.06 | 71.6 | — | |
| URNBackbone=Res2Net-101, Supervision=I2021.12 | 71.5 | — | |
| SBCESupervision=I, Backbone=ResNet1012024.06 | 71.3 | — | |
| ViT-PCMType=single-staged, Backbone=ViT-B/162024.02 | 70.9 | — | |
| VIT-PCMSupervision=I, Backbone=ResNet1012024.06 | 70.9 | — | |
| URNBackbone=ScaleNet-101, Supervision=I2021.12 | 70.8 | — | |
| URNBackbone=ResNet-38, Supervision=I2021.12 | 70.6 | — | |
| EDAMBackbone=ResNet-101, Supervision=Image-level tags + Saliency2022.03 | 70.6 | — | |
| AMNSupervision=I, Backbone=ResNet1012024.06 | 70.6 | — | |
| PMMBackbone=Res2Net-101, Supervision=I2021.12 | 70.5 | — | |
| PMMBackbone=Res2Net101, RW=false2021.08 | 70.5 | — | |
| PMMExtra Info=None, Backbone=Res2Net2021.08 | 70.5 | — | |
| LIIDBackbone=Res2Net-101, Supervision=I+SOP2021.12 | 70.4 | — | |
| LIIDExtra Info=Segment-based object proposals (SOP), Backbone=ResNet2021.08 | 70.4 | — | |
| NSROMBackbone=ResNet, Pre-trained on MS-COCO=true2021.03 | 70.2 | — | |
| NSROM*Supervision=Image-level labels + External saliency models, Backbone=ResNet-101, Pre-trained on MS-COCO=true2021.10 | 70.2 | — | |
| AdvCAM + W-OoDBackbone=WResNet-38, Supervision=Image-level tags2022.03 | 70.1 | — | |
| W-OODType=multi-staged, Backbone=ResNet382024.02 | 70.1 | — | |
| FPRType=multi-staged, Backbone=ResNet1012024.02 | 70.1 | — | |
| W-OODSupervision=I, Backbone=ResNet382024.06 | 70.1 | — | |
| CLIMSType=multi-staged, Backbone=ResNet1012024.02 | 70 | — | |
| AdvCAM + W-OoDBackbone=ResNet-101, Supervision=Image-level tags2022.03 | 69.9 | — | |
| URNBackbone=ResNet-101, Supervision=I2021.12 | 69.7 | — | |
| SIPESupervision=I, Backbone=ResNet1012024.06 | 69.7 | — | |
| SLRNet distilled*Backbone=ResNet38, Supervision=Image labels (I), Training Stages=Multi-stage (DeeplabV3+ refinement)2022.03 | 69.4 | — | |
| Ours (SEAM-based)Supervision=I, Backbone=ResNet382024.06 | 69.3 | — | |
| PMMBackbone=ResNet-38, Supervision=I2021.12 | 69 | — | |
| PMMBackbone=WResNet-38, Supervision=Image-level tags2022.03 | 69 | — | |
| PMMBackbone=ResNet38, RW=false2021.08 | 69 | — | |
| PMMExtra Info=None, Backbone=ResNet2021.08 | 69 | — | |
| ICD + ADELESupervision=Image-level labels, Backbone=ResNet-382021.10 | 68.9 | — | |
| SEAM + ADELESupervision=Image-level labels, Backbone=ResNet-382021.10 | 68.8 | — | |
| A2GNNBackbone=ResNet-101, Supervision=Image-level tags + Saliency2022.03 | 68.7 | — | |
| AuxSegNetBackbone=WResNet-38, Supervision=Image-level tags + Saliency2022.03 | 68.6 | — | |
| NSROMBackbone=ResNet, Pre-trained on MS-COCO=false2021.03 | 68.5 | — | |
| Li et al.Backbone=ResNet-101, Supervision=I+S2021.12 | 68.5 | — | |
| Yao et al.Backbone=ResNet-101, Supervision=Image-level tags + Saliency2022.03 | 68.5 | — | |
| NSROMSupervision=Image-level labels + External saliency models, Backbone=ResNet-1012021.10 | 68.5 | — | |
| GSMType=multi-staged, Backbone=ResNet1012024.02 | 68.5 | — | |
| Li et al.Extra Info=External saliency models (S), Backbone=ResNet2021.08 | 68.5 | — | |
| RECAMSupervision=I, Backbone=ResNet1012024.06 | 68.2 | — | |
| ICDBackbone=ResNet, Publication=CVPR20, Pre-trained on MS-COCO=false2021.03 | 68 | — | |
| ICDBackbone=ResNet-101, Supervision=I+S2021.12 | 68 | — | |
| CSEBackbone=WResNet-38, Supervision=Image-level tags2022.03 | 68 | — | |
| AdvCAMType=multi-staged, Backbone=ResNet1012024.02 | 68 | — | |
| ICDExtra Info=External saliency models (S), Backbone=ResNet2021.08 | 68 | — | |
| PMMBackbone=ScaleNet-101, Supervision=I2021.12 | 67.7 | — | |
| PMMBackbone=ScaleNet101, RW=false2021.08 | 67.7 | — | |
| PMMExtra Info=None, Backbone=ScaleNet2021.08 | 67.7 | — | |
| SLRNetBackbone=ResNet38, Supervision=Image labels (I), Training Stages=Single-stage2022.03 | 67.6 | — | |
| SDIBackbone=ResNet-101, Supervision=I+D+BSDS2021.12 | 67.5 | — | |
| LIIDBackbone=ResNet-101, Supervision=I+SOP2021.12 | 67.5 | — | |
| SDIExtra Info=D+BSDS, Backbone=ResNet2021.08 | 67.5 | — | |
| LIIDExtra Info=Segment-based object proposals (SOP), Backbone=ResNet2021.08 | 67.5 | — | |
| MCIS (ResNet)Backbone=ResNet, Training Data (Extra noisy web images/videos)=true2020.07 | 67.5 | — | |
| SGANBackbone=ResNet-101, Supervision=I+S2021.12 | 67.2 | — | |
| SGANExtra Info=External saliency models (S), Backbone=ResNet2021.08 | 67.2 | — | |
| AdvCAMBackbone=ResNet-101, Supervision=Image-level tags, reproduced=true2022.03 | 67.1 | — | |
| MCISBackbone=ResNet, Publication=ECCV20, Pre-trained on MS-COCO=false2021.03 | 66.9 | — | |
| Sun et al.Backbone=ResNet-101, Supervision=I2021.12 | 66.9 | — | |
| Sun et al.Backbone=ResNet-101, Supervision=Image-level tags + Saliency2022.03 | 66.9 | — | |
| MCISSupervision=Image-level labels + External saliency models, Backbone=ResNet-1012021.10 | 66.9 | — | |
| MCISBackbone=ResNet101, Supervision=Image labels (I), Saliency (S), Training Stages=Multi-stage2022.03 | 66.9 | — | |
| Sun et al.Backbone=ResNet101, RW=true2021.08 | 66.9 | — | |
| CDAType=multi-staged, Backbone=ResNet382024.02 | 66.8 | — | |
| Zhang et al.Backbone=ResNet, Publication=ECCV20, Pre-trained on MS-COCO=false2021.03 | 66.7 | — | |
| Fan et al.Backbone=ResNet, Publication=ECCV20, Pre-trained on MS-COCO=false2021.03 | 66.7 | — | |
| CONTABackbone=ResNet, Publication=NIPS20, Pre-trained on MS-COCO=false2021.03 | 66.7 | — | |
| CONTABackbone=ResNet-38, Supervision=I2021.12 | 66.7 | — | |
| CONTABackbone=WResNet-38, Supervision=Image-level tags2022.03 | 66.7 | — | |
| SPLIT MERGESupervision=Image-level labels + External saliency models, Backbone=ResNet-502021.10 | 66.7 | — | |
| CONTABackbone=ResNet38, Supervision=Image labels (I), Training Stages=Multi-stage2022.03 | 66.7 | — | |
| CONTABackbone=ResNet38, RW=true2021.08 | 66.7 | — | |
| BESBackbone=ResNet, Publication=ECCV20, Pre-trained on MS-COCO=false2021.03 | 66.6 | — | |
| OAABackbone=ResNet, Publication=ICCV19, Pre-trained on MS-COCO=false2021.03 | 66.4 | — | |
| OAA'Backbone=ResNet-101, Supervision=I+S2021.12 | 66.4 | — | |
| OAA+Extra Info=External saliency models (S), Backbone=ResNet2021.08 | 66.4 | — | |
| AFAType=single-staged, Backbone=MiT-B12024.02 | 66.3 | — | |
| SCEBackbone=ResNet, Publication=CVPR20, Pre-trained on MS-COCO=false2021.03 | 65.9 | — | |
| SC-CAMBackbone=ResNet-101, Supervision=I2021.12 | 65.9 | — | |
| Chang et al.Backbone=ResNet-101, Supervision=Image-level tags2022.03 | 65.9 | — | |
| SCEBackbone=ResNet101, Supervision=Image labels (I), Training Stages=Multi-stage2022.03 | 65.9 | — | |
| SC-CAMBackbone=ResNet101, RW=true2021.08 | 65.9 | — | |
| SEAMBackbone=ResNet, Publication=CVPR20, Pre-trained on MS-COCO=false2021.03 | 65.7 | — |