Lightweight Recurrent Cross-modal Encoder for Video Question Answering
Open paper
Benchmark
Model
Rank
Results
visual-question-answering-on-msrvtt-qa-1
LRCE
#18
Accuracy: 0.42
visual-question-answering-on-msvd-qa-1
LRCE
#19
Accuracy: 0.478
Rank counts only results with a code link.