Action Recognition on NTU120 (cross-subject (CS))
95.3Top-1 AccuracyPoseC3D
Evaluation Results
| Method | Links | |
|---|---|---|
| PoseC3DModality (Pose)=Used at inference, Modality (RGB)=Used at inference2023.11 | 95.3 | |
| π-ViT + 3D PosesModality (Pose)=Used at inference, Modality (RGB)=Used at inference2023.11 | 95.1 | |
| 3MformerModality (Pose)=Used at inference, Modality (RGB)=Not used2023.11 | 92 | |
| π-ViTModality (Pose)=Used only in training, Modality (RGB)=Used at inference2023.11 | 91.9 | |
| + 3D-SIMModality (Pose)=Used only in training, Modality (RGB)=Used at inference2023.11 | 91.8 | |
| Video SwinModality (Pose)=Not used, Modality (RGB)=Used at inference2023.11 | 91.4 | |
| VPN++ + 3D PosesModality (Pose)=Used at inference, Modality (RGB)=Used at inference2023.11 | 90.7 | |
| TimeSformerModality (Pose)=Not used, Modality (RGB)=Used at inference2023.11 | 90.6 | |
| 3D-Def-TransformerModality (Pose)=Used at inference, Modality (RGB)=Used at inference2023.11 | 90.5 | |
| + 2D-SIMModality (Pose)=Used only in training, Modality (RGB)=Used at inference2023.11 | 90.5 | |
| DG-STGCN(A0.66)Backbone=DG-STGCN, Sparsity level=0.66, Mode=Multi-level Assembly2025.05 | 90.4 | |
| STAR-TransformerModality (Pose)=Used at inference, Modality (RGB)=Used at inference2023.11 | 90.3 | |
| InfoGCNModality (Pose)=Used at inference, Modality (RGB)=Not used2023.11 | 89.8 | |
| DG-STGCNBackbone=DG-STGCN2025.05 | 89.6 | |
| DG-STGCN(S0.6)Backbone=DG-STGCN, Sparsity level=0.6, Mode=Sparse2025.05 | 89.1 | |
| DG-STGCN(S0.8)Backbone=DG-STGCN, Sparsity level=0.8, Mode=Sparse2025.05 | 89 | |
| CTR-GCNBackbone=CTR-GCN2025.05 | 88.9 | |
| DG-STGCN(S0.95)Backbone=DG-STGCN, Sparsity level=0.95, Mode=Sparse2025.05 | 88.7 | |
| ST-GCN++Backbone=ST-GCN++2025.05 | 88.6 | |
| SKE2GRIDBackbone=SKE2GRID2025.05 | 87.3 | |
| MotionFormerModality (Pose)=Not used, Modality (RGB)=Used at inference2023.11 | 87 | |
| MS-G3DBackbone=MS-G3D2025.05 | 86.9 | |
| PoseConv3DBackbone=PoseConv3D2025.05 | 86.9 | |
| VPN++Modality (Pose)=Used only in training, Modality (RGB)=Used at inference2023.11 | 86.7 | |
| HyperformerModality (Pose)=Used at inference, Modality (RGB)=Not used2023.11 | 86.6 | |
| DSTA-NetBackbone=DSTA-Net2025.05 | 86.6 | |
| VPNModality (Pose)=Used at inference, Modality (RGB)=Used at inference2023.11 | 86.3 | |
| ViewCLRModality (Pose)=Not used, Modality (RGB)=Used at inference2023.11 | 86.2 | |
| PoseC3DModality (Pose)=Used at inference, Modality (RGB)=Not used2023.11 | 86 | |
| ShiftGCNBackbone=ShiftGCN2025.05 | 85.9 | |
| ViewConModality (Pose)=Not used, Modality (RGB)=Used at inference2023.11 | 85.6 | |
| FGCNBackbone=FGCN2025.05 | 85.4 | |
| DG-STGCN(S0.99)Backbone=DG-STGCN, Sparsity level=0.99, Mode=Sparse2025.05 | 85.3 | |
| AS-GCNBackbone=AS-GCN2025.05 | 78.3 | |
| RA-GCNBackbone=RA-GCN2025.05 | 78.3 | |
| ST-GCNBackbone=ST-GCN2025.05 | 70.7 |