Semantic Segmentation on PASCAL-Context (mIoU)
84.58mIoUTIGER-L
Evaluation Results
| Method | Links | |
|---|---|---|
| TIGER-LBackbone=ViT-L2026.06 | 84.58 | |
| TIGER-BBackbone=ViT-B2026.06 | 84.08 | |
| SAK2026.06 | 84.01 | |
| MTMamba++Decoder Type=Mamba-based decoder2026.05 | 81.94 | |
| SEM2026.06 | 81.66 | |
| TSP-TransformerDecoder Type=Transformer-based decoder2026.05 | 81.48 | |
| MLoREDecoder Type=Transformer-based decoder2026.05 | 81.41 | |
| MLoRE2026.06 | 81.41 | |
| TaskDiffusionDecoder Type=Diffusion-based decoder2026.05 | 81.21 | |
| MTMambaDecoder Type=Mamba-based decoder2026.05 | 81.11 | |
| MTMamba2026.06 | 81.11 | |
| RADIO2026.06 | 81.11 | |
| DINOv2-ViT-LBackbone=ViT-L2026.06 | 81.04 | |
| TaskPrompterDecoder Type=Transformer-based decoder2026.05 | 80.89 | |
| TaskPrompter2026.06 | 80.89 | |
| MTLSI-NetParams (M)=234, FLOPs (G)=7722026.04 | 80.86 | |
| B^3-NetDecoder Type=Bridge-feature-based decoder2026.05 | 80.81 | |
| TaskExpertParams (M)=420, FLOPs (G)=6222026.04 | 80.64 | |
| TaskExpert2026.06 | 80.64 | |
| InvPT++Params (M)=421, FLOPs (G)=6672026.04 | 80.22 | |
| InvPT++Decoder Type=Transformer-based decoder2026.05 | 80.22 | |
| BridgeNetDecoder Type=Bridge-feature-based decoder2026.05 | 79.89 | |
| InvPTDecoder Type=Transformer-based decoder2026.05 | 79.03 | |
| InvPT2026.06 | 79.03 | |
| MQTransformer2026.04 | 78.93 | |
| MQTransformerDecoder Type=Transformer-based decoder2026.05 | 78.93 | |
| MQTransformer2026.06 | 78.93 | |
| MTI-NetParams (M)=851, FLOPs (G)=7742026.04 | 78.31 | |
| MTI-Net2026.06 | 78.31 | |
| PAD-NetParams (M)=330, FLOPs (G)=7732026.04 | 78.01 | |
| PAD-Net2026.06 | 78.01 | |
| CLIP-ViT-LBackbone=ViT-L2026.06 | 77.75 | |
| ATRCParams (M)=340, FLOPs (G)=8712026.04 | 77.11 | |
| ATRC2026.06 | 77.11 | |
| OWLv2-ViT-LBackbone=ViT-L2026.06 | 73.22 | |
| ASTMTDecoder Type=CNN-based decoder2026.05 | 68 | |
| ATRC-BMTASDecoder Type=CNN-based decoder2026.05 | 67.67 | |
| ATRC-ASPPDecoder Type=CNN-based decoder2026.05 | 63.6 | |
| ATRCDecoder Type=CNN-based decoder2026.05 | 62.69 | |
| DiffusionMTL2026.06 | 62.55 | |
| MTI-NetDecoder Type=CNN-based decoder2026.05 | 61.7 | |
| SAM-ViT-BBackbone=ViT-B2026.06 | 54.88 | |
| PAD-NetDecoder Type=CNN-based decoder2026.05 | 53.6 | |
| DPFBackbone=ViT2023.03 | 45.31 | |
| MaskCLIP+paradigm=transductive2021.12 | 44.4 | |
| Fully Sup.2021.12 | 44.4 | |
| Zhao et al.rGMM=true2023.03 | 36.07 | |
| DeiTArch.=ViT, Init.=false, Training Data=ImageNet, Sup.=Class, Zero-Shot=false2022.11 | 35.9 | |
| Zhao et al.rGMM=false2023.03 | 33.54 | |
| Qian et al.Online Extension=true2023.03 | 30 | |
| Qian et al.Online Extension=false2023.03 | 29.7 | |
| ZS3Netparadigm=transductive2021.12 | 27 | |
| CaGNetparadigm=inductive2021.12 | 24.8 | |
| SegCLIPArch.=ViT, Init.=true, Training Data=CC+COCO, Sup.=Text, Zero-Shot=true2022.11 | 24.7 | |
| MoCoArch.=ViT, Init.=false, Training Data=CC12M+YFCC, Sup.=Self, Zero-Shot=false2022.11 | 23 | |
| DINOArch.=ViT, Init.=false, Training Data=CC12M+YFCC, Sup.=Self, Zero-Shot=false2022.11 | 22.8 | |
| GroupViTArch.=ViT, Init.=false, Training Data=CC12M+YFCC, Sup.=Text, Zero-Shot=true2022.11 | 22.4 | |
| ZS3Netparadigm=inductive2021.12 | 20.8 | |
| SegCLIPArch.=ViT, Init.=false, Training Data=CC+COCO, Sup.=Text, Zero-Shot=true2022.11 | 19.1 | |
| GroupViT1-sArch.=ViT, Init.=false, Training Data=CC+COCO, Sup.=Text, Zero-Shot=true, Stage=one-stage2022.11 | 14.8 | |
| GroupViT2-sArch.=ViT, Init.=false, Training Data=CC+COCO, Sup.=Text, Zero-Shot=true, Stage=two-stage2022.11 | 10.4 |