Learning Visual Question Answering by Bootstrapping Hard Attention

Benchmark Model Rank Results
visual-question-answering-on-clevrCNN + LSTM + RN + HAN#8Accuracy: 98.8
visual-question-answering-on-vqa-cpHAN#10Score: 28.65