R-VQA: Learning Visual Relation Facts with Semantic Attention for Visual Question Answering

Benchmark Model Rank Results
visual-question-answering-on-coco-visual-1RelAtt#3Percentage correct: 69.60
visual-question-answering-on-coco-visual-4RelAtt#3Percentage correct: 65.69