Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

OWT

Benchmarks

Task NameDataset NameSOTA ResultTrend
Language ModelingOWT (test)
Perplexity (PPL)17.5
79
Language ModelingOWT
Gen. PPL15.06
78
Text GenerationOWT
GPT2 Perplexity5.33
41
Conditional GenerationOWT
Perplexity (PPL)19.99
24
Language ModelingOWT (val)
PPL17.5
23
Language ModelingOWT L=1024 (test)
NELBO PPL20.96
11
Generative PerplexityOWT L=1024
Generative Perplexity14.1
6
Language ModelingOWT
PPL11.2
6
Generative PerplexityOWT L=2048
Generative Perplexity13.2
5
Generation LatencyOWT L=8192
Generation Latency (s)54
5
Generation LatencyOWT L=2048
Sampling Latency (s)13.3
5
Language ModelingOWT Qwen-2 tokenizer (val)
Validation Perplexity21.9
4
Language GenerationOWT (test)
MAUVE92.94
3
Language ModelingOWT L=10240 (test)
Gen. PPL23.4
2
Showing 14 of 14 rows