DenseCap: Fully Convolutional Localization Networks for Dense Captioning

Benchmark Model Rank Results
dense-captioning-on-visual-genomeFCLN#3mAP: 5.4
object-detection-on-visual-genomeAP (%)#3MAP: 5.39