LASER: Lip Landmark Assisted Speaker Detection for Robustness
Open paper
Benchmark
Model
Rank
Results
audio-visual-active-speaker-detection-on-ava-activespeaker
LoCoNet + Laser
#2
validation mean average precision: 95.3%
Rank counts only results with a code link.