Learning Visual Question Answering by Bootstrapping Hard Attention
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-clevr
CNN + LSTM + RN + HAN
#8
Accuracy: 98.8
visual-question-answering-on-vqa-cp
HAN
#10
Score: 28.65
Rank counts only results with a code link.