SciCap: Generating Captions for Scientific Figures

Benchmark Model Rank Results
image-captioning-on-scicapCNN+LSTM (Vision only, First sentence)#1BLEU-4: 0.0219
image-captioning-on-scicapCNN+LSTM (Text only, First sentence)#2BLEU-4: 0.0213
image-captioning-on-scicapCNN+LSTM (Text only, Single-Sent Caption)#3BLEU-4: 0.0212
image-captioning-on-scicapCNN+LSTM (Vision only, Single-Sent Caption)#4BLEU-4: 0.0207
image-captioning-on-scicapCNN+LSTM (Vision + Text, First sentence)#5BLEU-4: 0.0205
image-captioning-on-scicapCNN+LSTM (Vision + Text, Single-Sent Caption)#6BLEU-4: 0.0202
image-captioning-on-scicapCNN+LSTM (Vision only, Caption w/ <=100 words)#7BLEU-4: 0.0172
image-captioning-on-scicapCNN+LSTM (Vision + Text, Caption w/ <=100 words)#8BLEU-4: 0.0168
image-captioning-on-scicapCNN+LSTM (Text only, Caption w/ <=100 words)#9BLEU-4: 0.0165