Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Audio-Visual Speech Recognition on LRS3 Noisy w.r.t Missing Modality 0.1 Masking Ratio (test)
Loading...
4.07
Word Error Rate (%)
Auto-AVSR
3.702
6.186
8.67
11.154
Jun 4, 2026
Word Error Rate (%)
Updated 1mo ago
Evaluation Results
Method
Method
Links
Word Error Rate (%)
Auto-AVSR
Modality=A+V, Labeled...
2026.06
4.07
MMS-Llama
Modality=A+V, Labeled...
2026.06
4.53
M2S-AVSR
Modality=A+V, Labeled...
2026.06
4.6
M2S-AVSR
Modality=A+V, Labeled...
2026.06
4.64
Llama-AVSR
Modality=A+V, Labeled...
2026.06
4.73
MMS-Llama
Modality=A+V, Labeled...
2026.06
4.79
M2S-AVSR
Modality=A+V, Labeled...
2026.06
5.3
M2S-AVSR
Modality=A+V, Labeled...
2026.06
5.38
Whisper-Flamingo
Modality=A+V, Labeled...
2026.06
6.16
Whisper-Flamingo
Modality=A+V, Labeled...
2026.06
6.17
CMA
Modality=A+V, Labeled...
2026.06
6.33
Whisper-Flamingo
Modality=A+V, Labeled...
2026.06
6.37
Whisper-Flamingo
Modality=A+V, Labeled...
2026.06
6.72
AV-HuBERT
Modality=A+V, Labeled...
2026.06
7.29
AV-RelScore
Modality=A+V, Labeled...
2026.06
8.81
V-CAFE
Modality=A+V, Labeled...
2026.06
13.27
Feedback
Search any
task
Search any
task