Discriminative Multi-modality Speech Recognition

Benchmark Model Rank Results
audio-visual-speech-recognition-on-lrs3-tedEG-seq2seq#11Word Error Rate (WER): 6.8
lipreading-on-lip-reading-in-the-wild3D Conv + P3D-ResNet50 + TCN#13Top-1 Accuracy: 84.80
lipreading-on-lrs3-tedEG-seq2seq#14Word Error Rate (WER): 57.8