Co-attending Free-form Regions and Detections with Multi-modal Multiplicative Feature Embedding for Visual Question Answering

Benchmark Model Rank Results
visual-question-answering-on-coco-visual-1Dual-MFA#2Percentage correct: 70.04
visual-question-answering-on-coco-visual-4Dual-MFA#2Percentage correct: 66.09