Abstract:Facial expression data is characterized by a significant imbalance, with most collected data showing happy or neutral expressions and fewer instances of fear or disgust. This imbalance poses challenges to facial expression recognition (FER) models, hindering their ability to fully understand various human emotional states. Existing FER methods typically report overall accuracy on highly imbalanced test sets but exhibit low performance in terms of the mean accuracy across all expression classes. In this paper, our aim is to address the imbalanced FER problem. Existing methods primarily focus on learning knowledge of minor classes solely from minor-class samples. However, we propose a novel approach to extract extra knowledge related to the minor classes from both major and minor class samples. Our motivation stems from the belief that FER resembles a distribution learning task, wherein a sample may contain information about multiple classes. For instance, a sample from the major class surprise might also contain useful features of the minor class fear. Inspired by that, we propose a novel method that leverages re-balanced attention maps to regularize the model, enabling it to extract transformation invariant information about the minor classes from all training samples. Additionally, we introduce re-balanced smooth labels to regulate the cross-entropy loss, guiding the model to pay more attention to the minor classes by utilizing the extra information regarding the label distribution of the imbalanced training data. Extensive experiments on different datasets and backbones show that the two proposed modules work together to regularize the model and achieve state-of-the-art performance under the imbalanced FER task. Code is available at <a class="link-external link-https" href="https://github.com/zyh-uaiaaaa" rel="external noopener nofollow">this https URL</a>.

FERMixNet: an Occlusion Robust Facial Expression Recognition Model with Facial Mixing Augmentation and Mid-Level Representation Learning

DR-FER: Discriminative and Robust Representation Learning for Facial Expression Recognition

Cgan Based Facial Expression Recognition for Human-Robot Interaction

SDNET: Lightweight Facial Expression Recognition For Sample Disequilibrium.

Facial expression recognition in facial occlusion scenarios: A path selection multi-network

Region Attention Networks for Pose and Occlusion Robust Facial Expression Recognition

Robust Lightweight Facial Expression Recognition Network with Label Distribution Training

Efficient Facial Expression Recognition with Representation Reinforcement Network and Transfer Self-Training for Human–Machine Interaction

Facial Expression Recognition with Contrastive Learning and Uncertainty-Guided Relabeling

Latent-OFER: Detect, Mask, and Reconstruct with Latent Vectors for Occluded Facial Expression Recognition

Facial expression recognition through multi-level features extraction and fusion

Hybrid Attention-Aware Learning Network for Facial Expression Recognition in the Wild

Adaptive multilayer perceptual attention network for facial expression recognition

Leave No Stone Unturned: Mine Extra Knowledge for Imbalanced Facial Expression Recognition

Multi-Net Fusion: Exploring a Brain-Inspired Neural Network Model for Facial Expression Recognition

Multi Loss-based Feature Fusion and Top Two Voting Ensemble Decision Strategy for Facial Expression Recognition in the Wild

MixAugment & Mixup: Augmentation Methods for Facial Expression Recognition

Joint Expression Synthesis and Representation Learning for Facial Expression Recognition

Facial Expression Recognition With Visual Transformers and Attentional Selective Fusion

A-MobileNet: An approach of facial expression recognition