Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

RAVDESS

Benchmarks

Task NameDataset NameSOTA ResultTrend
Audio-driven Talking Head GenerationRAVDESS (cross-identity)
FAD1.885
64
Talking Head GenerationRAVDESS intra-identity 1.0
FAD0.833
56
Talking Face GenerationRAVDESS
Realism70
48
Emotion RecognitionRAVDESS
Accuracy72
46
Speech Emotion RecognitionRAVDESS
Unweighted Accuracy92.58
43
Emotion RecognitionRAVDESS (test)
Accuracy0.9735
29
Audio ClassificationRAVDESS
Base Accuracy72.85
27
Audio-Driven Facial AnimationRAVDESS 42 (test)
PSNR30.772
24
Emotion RecognitionRAVDESS (val)
Accuracy97.46
20
Emotion RecognitionRAVDESS 7-class
WAR83.61
19
Discrete Emotion RecognitionRavdess 19 (test)
Accuracy44.04
19
Avatar FingerprintingRAVDESS (Evaluation)
AUC (%)83
12
Speech Emotion RecognitionRAVDESS 8 classes (test)
Weighted Accuracy84.72
12
Speech Emotion RecognitionRAVDESS In-Domain v1 (test)
Accuracy85.74
12
Audiovisual Emotion RecognitionRAVDESS
Accuracy (AV)81.58
12
Song Emotion RecognitionRAVDESS Song
Weighted Accuracy85.8
11
Response AppropriatenessRAVDESS
Response Appropriateness48
9
Emotion RecognitionRAVDESS (6-fold cross-val)
Accuracy74.86
9
Emotion classificationRAVDESS four-class subset n=672
Accuracy71
8
Visual-to-Audio PredictionRAVDESS
Accuracy82.78
8
Audio-to-Visual PredictionRAVDESS
Accuracy76.06
8
Talking-head generationRAVDESS
IQA Score4.602
8
Speech Emotion RecognitionRAVDESS (6-fold subject-independent cross-validation)
Weighted Accuracy (WA)93.4
8
Emotion RecognitionRAVDESS (speaker-independent)
UAR82.29
8
Facial Emotion RecognitionRAVDESS
WAR87.99
8
Showing 25 of 38 rows