Mutual Information Divergence: A Unified Metric for Multimodal Generative Models

Benchmark Model Rank Results
human-judgment-classification-on-pascal-50sMID#1Mean Accuracy: 85.2
human-judgment-correlation-on-flickr8k-cfMID#1Kendall's Tau-b: 37.3
human-judgment-correlation-on-flickr8k-expertMID#1Kendall's Tau-c: 54.9