Dynamic Facial Expression Recognition on MAFW (test)
43.38UARSSM
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| SSMBackbone=CLIP-ViT-B/16, Learning Protocol=Joint learning2026.04 | 43.38 | 57.26 | |
| CLVSRBackbone=CLIP-ViT-B/16, Learning Strategy=Vision-language2026.04 | 42.51 | 52.69 | |
| A3lign-DFERBackbone=CLIP-ViT-L/14, Learning Strategy=Vision-language2026.04 | 42.07 | 53.24 | |
| STLBackbone=CLIP-ViT-B/16, Learning Protocol=Single-task learning2026.04 | 41.81 | 56.15 | |
| MAE-DFERBackbone=ViT-B/16, Learning Strategy=Self-supervised2026.04 | 41.62 | 54.31 | |
| DFLMBackbone=CLIP-ViT-B/32, Learning Strategy=Vision-language2026.04 | 41.23 | 53.65 | |
| SVFAPBackbone=ViT-B/16, Learning Strategy=Self-supervised2026.04 | 41.19 | 54.28 | |
| CLIP-Guided-DFERBackbone=CLIP-ViT-B/32, Learning Strategy=Vision-language2026.04 | 41.06 | 54.38 | |
| DFER-CLIPBackbone=CLIP-ViT-B/32, Learning Strategy=Vision-language2026.04 | 39.89 | 52.55 | |
| IFDD-3DViTBackbone=ViT-B/16, Learning Strategy=Supervised2026.04 | 39.31 | 53.92 | |
| EmoCLIPBackbone=CLIP-ViT-B/32, Learning Strategy=Vision-language2026.04 | 34.24 | 41.46 | |
| Former-DFERBackbone=Transformer, Learning Strategy=Supervised2026.04 | 31.16 | 43.27 |