HCAM -- Hierarchical Cross Attention Model for Multi-modal Emotion Recognition

Benchmark Model Rank Results
emotion-recognition-in-conversation-on-meldAudio + Text (Stage III)Weighted-F1: 65.8
multimodal-emotion-recognition-on-iemocap-4Audio + Text (Stage III)F1: 70.5
multimodal-emotion-recognition-on-meldAudio + Text (Stage III)Weighted F1: 65.8