2D Pose Estimation on AIC (test)
37.1mAPHulk-FT
Evaluation Results
| Method | Links | |
|---|---|---|
| Hulk-FTBackbone=ViT-L, Model Category=Generalist, Input Resolution=256×192, Evaluation Protocol=Fine-tuned2023.12 | 37.1 | |
| Hulk-FTBackbone=ViT-L, Input Resolution=256x192, Fine-tuned=true2023.12 | 37.1 | |
| PATHBackbone=ViT-L, Model Category=Pretraining, Input Resolution=256×1922023.12 | 36.3 | |
| HulkBackbone=ViT-L, Model Category=Generalist, Input Resolution=256×192, Evaluation Protocol=Direct2023.12 | 36.3 | |
| PATHBackbone=ViT-L, Input Resolution=256x1922023.12 | 36.3 | |
| HulkBackbone=ViT-L, Input Resolution=256x192, Fine-tuned=false2023.12 | 36.3 | |
| Hulk-FTBackbone=ViT-B, Model Category=Generalist, Input Resolution=256×192, Evaluation Protocol=Fine-tuned2023.12 | 35.6 | |
| Hulk-FTBackbone=ViT-B, Input Resolution=256x192, Fine-tuned=true2023.12 | 35.6 | |
| PATHBackbone=ViT-B, Model Category=Pretraining, Input Resolution=256×1922023.12 | 35 | |
| PATHBackbone=ViT-B, Input Resolution=256x1922023.12 | 35 | |
| ViTPose-LBackbone=ViT-L, Model Category=Specialist, Input Resolution=256×192, Evaluation Protocol=Our implementation2023.12 | 34.5 | |
| HulkBackbone=ViT-B, Model Category=Generalist, Input Resolution=256×192, Evaluation Protocol=Direct2023.12 | 34.5 | |
| ViTPose-LBackbone=ViT-L, Input Resolution=256x192, Implementation=Our implementation2023.12 | 34.5 | |
| HulkBackbone=ViT-B, Input Resolution=256x192, Fine-tuned=false2023.12 | 34.5 | |
| ViTPose++-LBackbone=ViT-L, Input Resolution=256x192, Multiple Datasets=true2023.12 | 34.3 | |
| UniHCP-FTBackbone=ViT-B, Model Category=Generalist, Input Resolution=256×192, Evaluation Protocol=Fine-tuned2023.12 | 33.6 | |
| UniHCP-FTBackbone=ViT-B, Input Resolution=256x192, Fine-tuned=true2023.12 | 33.6 | |
| UniHCPBackbone=ViT-B, Model Category=Generalist, Input Resolution=256×192, Evaluation Protocol=Direct2023.12 | 32.5 | |
| UniHCPBackbone=ViT-B, Input Resolution=256x192, Fine-tuned=false2023.12 | 32.5 | |
| HAPBackbone=ViT-B, Model Category=Pretraining, Input Resolution=256×1922023.12 | 32.3 | |
| HAPBackbone=ViT-B, Input Resolution=256x1922023.12 | 32.3 | |
| ViTPose-BBackbone=ViT-B, Model Category=Specialist, Input Resolution=256×192, Evaluation Protocol=Our implementation2023.12 | 32 | |
| ViTPose-BBackbone=ViT-B, Input Resolution=256x192, Implementation=Our implementation2023.12 | 32 | |
| ViTPose++-BBackbone=ViT-B, Input Resolution=256x192, Multiple Datasets=true2023.12 | 31.9 |