Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

WikiText-103

Benchmarks

Task NameDataset NameSOTA ResultTrend
Language ModelingWikiText-103 (test)
Perplexity2.22
773
Language ModelingWikiText-103 (val)
PPL1.01
290
Language ModelingWikiText-103
PPL4.59
216
Word-level Language ModelingWikiText-103 word-level (test)
Perplexity15.79
65
Word-level language modelingWikiText-103 (dev)
Perplexity15.72
64
Language ModelingWikiText-103 v1 (test)
Perplexity10.48
56
Text ContinuationWikiText-103 512-token continuation (test)
Perplexity (PPL)1
47
Language ModelingWikiText-103
Perplexity (PPL)5.47
43
Language ModelingWikitext-103
PPL3.14
42
Language GenerationWikiText-103
Perplexity (PPL)1
41
Language ModelingWikiText-103 (dev)
Perplexity17.9
40
Language ModelingWikiText-103 zero-shot (test)
PPL12.76
34
Language ModelingWikiText-103 clean (test)
Perplexity23.32
30
Language ModelingWikitext-103
Perplexity (PPL)14.8
28
Open-ended generationWikitext-103 (test)
MAUVE0.96
26
TokenizationWikiText-103
Latency (ms)1.92
25
Language ModelingWikiText-103
Delta PPL0
25
Language ModelingWikiText-103 word-level (val)
Perplexity7.533
25
Text generationWikitext-103
Perplexity32.88
23
Language ModelingWikiText-103 Attacked (test)
Perplexity (PPL)41.351
21
Language ModelingWikiText-103 Attacked (val)
Perplexity39.677
21
Steganographic secret extractionWikiText-103 W (test)
Accuracy75
20
Language ModelingWikiText-103 small setting (test)
Perplexity32.8
20
Language ModelingWikiText-103 small setting (val)
Perplexity31.8
20
Language ModelingWikiText-103 (train)
PPL15.18
19
Showing 25 of 92 rows