Motion-Appearance Co-Memory Networks for Video Question Answering

Benchmark Model Rank Results
visual-question-answering-on-msrvtt-qa-1Co-MemAccuracy: 0.32
visual-question-answering-on-msvd-qa-1Co-MemAccuracy: 0.317