Learning to Reason: End-to-End Module Networks for Visual Question Answering

Benchmark Model Rank Results
visual-dialog-on-visual-dialog-v1-0-test-stdNMN#4NDCG (x 100): 58.1MRR (x 100): 58.8R@1: 44.15R@5: 76.88
visual-question-answering-on-vqa-v2-test-devN2NMN (ResNet-152, policy search)#40Accuracy: 64.9