FiLM: Visual Reasoning with a General Conditioning Layer

Benchmark Model Rank Results
visual-question-answering-on-clevrCNN+GRU+FiLM#10Accuracy: 97.7
visual-question-answering-on-clevr-humansCNN+GRU+FiLM#3Accuracy: 75.9