Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

XL-Sum

Benchmarks

Task NameDataset NameSOTA ResultTrend
Abstractive SummarizationXL-Sum (test)
Language Democratization67.21
20
SummarizationXL-SUM Target language
SUM Score23.2
16
SummarizationXL-SUM en
SUM Score24.5
16
Abstractive SummarizationXL-Sum Ukrainian (test)
BLEU Score6.52
14
SummarizationXL-Sum Arabic (test)
ROUGE-L22.32
12
SummarizationXL-Sum
ROUGE-L20.93
12
SummarizationXL-Sum Chinese (test)
BERTScore-F133.62
7
Multilingual SummarizationXL-SUM ar
Token-level Language Confusion (%)0.37
5
Multilingual SummarizationXL-SUM hi
Token-level Language Confusion0.23
5
Multilingual SummarizationXL-SUM th
Token-level Language Confusion0.38
5
Multilingual SummarizationXL-SUM ko
Token-level Language Confusion3.45
5
Multilingual SummarizationXL-SUM fr
Token-level Language Confusion (%)11
5
Multilingual SummarizationXL-SUM ja
Token-level Language Confusion3.51
5
Multilingual SummarizationXL-SUM zh
Token-level Language Confusion (%)4.78
5
Multilingual SummarizationXL-SUM ru
Token-level Language Confusion0.28
5
SummarizationXL-Sum (test)
ROUGE-L13.9
5
Abstractive Text SummarizationXL-Sum English (test)
ROUGE-139.121
2
Showing 17 of 17 rows