Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

WikiText-2

Benchmarks

Task NameDataset NameSOTA ResultTrend
Language ModelingWikiText-2
Perplexity (PPL)1.08
2,862
Language ModelingWikiText-2
Perplexity3.84
205
Language ModelingWikiText-2 (val)
Perplexity (BVS)4.73
179
Language modelingWikitext-2
Perplexity (PPL)5.47
146
Text GenerationWikiText-2
Perplexity4.88
138
PerplexityWikiText-2
Perplexity2.81
113
Open-ended text generationWikiText-2
COH Score0.811
112
KV Cache QuantizationWikiText-2 prompt 2048-token (train)
Softmax KL Divergence0.0026
99
Language ModelingWikiText-2
WikiText-2 Score4.41
86
Language ModelingWikiText-2
Average Kurtosis93.039
72
Language ModelingWikiText-2
PPL3.52
64
Language ModelingWikiText-2 raw (test)
Perplexity5.674
63
Language ModelingWikiText-2
Perplexity (PPL)5.82
40
Language ModelingWikiText-2
Mauve0.9
33
Feature Space PreservationWikiText-2
Cosine Similarity100
32
Language ModelingWikiText-2 context length 2048 (val)
WikiText-2 PPL9.92
24
Language ModelingWikiText-2 Llama-3.1-8B-Instruct (test)
Perplexity7.2
22
Language ModelingWikiText-2 v1 (val)
Perplexity42.41
20
Language ModelingWikiText-2
Perplexity (PPL)4.91
19
Language ModelingWikiText-2 10K-word evaluator standardized
PPL Delta (%)11.9
18
Language ModelingWikiText-2 (val)
PPL (10% sparsity)20
17
Language ModelingWikitext-2 v1 (test)
Perplexity (PPL)7.33
17
Language ModelingWikitext 2 Llama 2 & 3 (test)
PPL (Llama 2, Config 7)5.47
16
Language GenerationWikiText-2 (test)
Perplexity3.319
16
Text GenerationWikiText-2
ROUGE-139.1
15
Showing 25 of 66 rows