Facial Expression Recognition on Ava265-HMC
53.42UARSynHMC
Evaluation Results
| Method | Links | ||
|---|---|---|---|
| SynHMCPre-training Dataset=SynHMC-7K, Reconstruction Method=SynHMC (Ours), Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 53.42 | 54.4 | |
| FFHQ-UVPre-training Dataset=SynHMC-7K, Reconstruction Method=FFHQ-UV [3], Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 51.76 | 52.9 | |
| FDSPre-training Dataset=SynHMC-7K, Reconstruction Method=FDS [7], Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 50.73 | 52.05 | |
| AffectNet-7KPre-training Dataset=AffectNet-7K [36], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 50.27 | 51.75 | |
| EMOCAPre-training Dataset=SynHMC-7K, Reconstruction Method=EMOCA [10], Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 49.41 | 50.89 | |
| DECAPre-training Dataset=SynHMC-7K, Reconstruction Method=DECA [15], Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 46.82 | 48.25 | |
| ImageNet Pre-trainedPre-training Dataset=ImageNet [11], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 46.4 | 47.96 | |
| SynHMCPre-training Dataset=SynHMC-7K, Reconstruction Method=SynHMC (Ours), Evaluation Protocol=K-NN, Backbone=Swin-T2026.07 | 40.53 | 42.03 | |
| SynHMCPre-training Dataset=SynHMC-7K, Reconstruction Method=SynHMC (Ours), Evaluation Protocol=Linear Probe, Backbone=Swin-T2026.07 | 38.27 | 41.04 | |
| FDSPre-training Dataset=SynHMC-7K, Reconstruction Method=FDS [7], Evaluation Protocol=K-NN, Backbone=Swin-T2026.07 | 37.66 | 39.13 | |
| FFHQ-UVPre-training Dataset=SynHMC-7K, Reconstruction Method=FFHQ-UV [3], Evaluation Protocol=K-NN, Backbone=Swin-T2026.07 | 36.58 | 38.33 | |
| FDSPre-training Dataset=SynHMC-7K, Reconstruction Method=FDS [7], Evaluation Protocol=Linear Probe, Backbone=Swin-T2026.07 | 35.68 | 38.42 | |
| FFHQ-UVPre-training Dataset=SynHMC-7K, Reconstruction Method=FFHQ-UV [3], Evaluation Protocol=Linear Probe, Backbone=Swin-T2026.07 | 34.23 | 37.33 | |
| DECAPre-training Dataset=SynHMC-7K, Reconstruction Method=DECA [15], Evaluation Protocol=K-NN, Backbone=Swin-T2026.07 | 33.73 | 35.42 | |
| AffectNet-7KPre-training Dataset=AffectNet-7K [36], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=K-NN, Backbone=Swin-T2026.07 | 33.65 | 34.43 | |
| EMOCAPre-training Dataset=SynHMC-7K, Reconstruction Method=EMOCA [10], Evaluation Protocol=K-NN, Backbone=Swin-T2026.07 | 33.27 | 34.73 | |
| EMOCAPre-training Dataset=SynHMC-7K, Reconstruction Method=EMOCA [10], Evaluation Protocol=Linear Probe, Backbone=Swin-T2026.07 | 32.04 | 35.25 | |
| AffectNet-7KPre-training Dataset=AffectNet-7K [36], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=Linear Probe, Backbone=Swin-T2026.07 | 31.74 | 34.04 | |
| DECAPre-training Dataset=SynHMC-7K, Reconstruction Method=DECA [15], Evaluation Protocol=Linear Probe, Backbone=Swin-T2026.07 | 29.78 | 32.84 | |
| SynHMCPre-training Dataset=SynHMC-7K, Reconstruction Method=SynHMC (Ours), Evaluation Protocol=Direct Test, Backbone=Swin-T2026.07 | 27.93 | 27.79 | |
| FFHQ-UVPre-training Dataset=SynHMC-7K, Reconstruction Method=FFHQ-UV [3], Evaluation Protocol=Direct Test, Backbone=Swin-T2026.07 | 25.78 | 26.49 | |
| MEADPre-training Dataset=MEAD [55], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=Linear Probe, Backbone=Swin-T2026.07 | 23.68 | 26.31 | |
| MEADPre-training Dataset=MEAD [55], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=K-NN, Backbone=Swin-T2026.07 | 23.49 | 25.4 | |
| MEADPre-training Dataset=MEAD [55], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 22.45 | 25.97 | |
| FDSPre-training Dataset=SynHMC-7K, Reconstruction Method=FDS [7], Evaluation Protocol=Direct Test, Backbone=Swin-T2026.07 | 21.45 | 19.62 | |
| DECAPre-training Dataset=SynHMC-7K, Reconstruction Method=DECA [15], Evaluation Protocol=Direct Test, Backbone=Swin-T2026.07 | 21.35 | 20.02 | |
| EMOCAPre-training Dataset=SynHMC-7K, Reconstruction Method=EMOCA [10], Evaluation Protocol=Direct Test, Backbone=Swin-T2026.07 | 19.38 | 18.75 | |
| AffectNet-7KPre-training Dataset=AffectNet-7K [36], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=Direct Test, Backbone=Swin-T2026.07 | 19.13 | 18.2 | |
| MEADPre-training Dataset=MEAD [55], Reconstruction Method=None (Frontal-view images), Evaluation Protocol=Direct Test, Backbone=Swin-T2026.07 | 15.78 | 16.27 | |
| Randomly Initialized FERPre-training Dataset=None, Reconstruction Method=None (Frontal-view images), Evaluation Protocol=Fine-tune, Backbone=Swin-T2026.07 | 14.56 | 17.82 |