Multimodal Residual Learning for Visual QA

Benchmark Model Rank Results
visual-question-answering-on-coco-visual-1MRN#5Percentage correct: 66.3
visual-question-answering-on-coco-visual-4MRN + global features#5Percentage correct: 61.8