Naver at ActivityNet Challenge 2019 -- Task B Active Speaker Detection (AVA)
Open paper
Benchmark
Model
Rank
Results
audio-visual-active-speaker-detection-on-ava-activespeaker
VGG-{LSTM+TCN} (ensemble)
–
validation mean average precision: 87.8%
Rank counts only results with a code link.