Exploiting Multiple Sequence Lengths in Fast End to End Training for Image Captioning
Open paper
Benchmark
Model
Rank
Results
image-captioning-on-coco
ExpansionNet v2
#1
CIDEr: 143.7
image-captioning-on-coco-captions
ExpansionNet v2 (No VL pretraining)
#6
BLEU-4: 42.7
CIDER: 143.7
METEOR: 30.6
SPICE: 24.7
ROUGE-L: 61.1
…
Rank counts only results with a code link.