| Benchmark | Model | Rank | Results |
|---|---|---|---|
| emotion-recognition-in-conversation-on-meld | Audio + Text (Stage III) | – | Weighted-F1: 65.8 |
| multimodal-emotion-recognition-on-iemocap-4 | Audio + Text (Stage III) | – | F1: 70.5 |
| multimodal-emotion-recognition-on-meld | Audio + Text (Stage III) | – | Weighted F1: 65.8 |