Facial Expression Recognition on RML (test)
76.53AccuracyARPGNet
Evaluation Results
| Method | Links | |
|---|---|---|
| ARPGNetStream Type=Multi-stream, Backbone=default2025.11 | 76.53 | |
| C3D (with audio modality)Stream Type=Single-stream, Modality=Audio + Visual2025.11 | 73.9 | |
| Pooling + DBNStream Type=Multi-stream2025.11 | 73.7 | |
| MulTStream Type=Multi-stream, Backbone=same as ARPGNet, Fusion Method=MulT2025.11 | 73.33 | |
| Two-stageStream Type=Single-stream2025.11 | 72.5 | |
| HSE-NNStream Type=Single-stream2025.11 | 72.2 | |
| TEMMAStream Type=Multi-stream, Backbone=same as ARPGNet, Fusion Method=TEMMA2025.11 | 71.11 | |
| PACVTStream Type=Multi-stream2025.11 | 70.1 | |
| MDANStream Type=Single-stream2025.11 | 69.3 | |
| AM-CNNStream Type=Multi-stream2025.11 | 68.6 | |
| Multi-attentionStream Type=Multi-stream, Backbone=same as ARPGNet, Fusion Method=Multi-attention2025.11 | 68.33 | |
| C3DStream Type=Single-stream2025.11 | 68.1 | |
| APViTStream Type=Single-stream2025.11 | 67.6 | |
| LSTM + LALStream Type=Multi-stream2025.11 | 65.7 | |
| Former-DFERStream Type=Single-stream2025.11 | 62.5 | |
| PoolingStream Type=Single-stream2025.11 | 60.8 | |
| LSTM + RLStream Type=Single-stream2025.11 | 60.2 |