Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

SlimPajama

Benchmarks

Task NameDataset NameSOTA ResultTrend
Language ModelingSlimPajama
Perplexity (PPL)2.97
77
Language ModelingSlimPajama latest (val)
Validation Loss3.078
26
Language ModelingSlimPajama (test)
PPL (CommonCrawl)0.5402
25
Language ModelingSlimPajama data-restricted
Average Perplexity24.35
17
Language ModelingSlimPajama (val)
Perplexity3.09
13
Language ModelingSlimPajama large-scale (train)
L(ψ)2.129
8
Language ModelingSlimPajama Data Abundant Regime 6B (test)
Arxiv Perplexity11.46
6
Language ModelingSlimPajama data-restricted regime 6B (test)
Perplexity (Arxiv)16.85
6
Language ModelingSlimPajama-672B (val)
Validation Perplexity8.09
6
Language ModelingSlimPajama 6B (val)
Validation Loss2.3
4
Language ModelingSlimPajama-6B (train)
Train Loss2.1
4
Factuality EvaluationSlimPajama
Pointwise Score63.5
3
Generation Quality and Coherence EvaluationSlimPajama Quality Evaluation (test)
Gen Quality (Std. Prefix)86.3
3
Language ModelingSlimPajama 10M (dev)
Perplexity9.219
3
Language ModelingSlimPajama 6B tokens
Arxiv Perplexity10.26
2
Self-attention inverse temperature scaling analysisSlimPajama
Tie Percentage6
2
Showing 16 of 16 rows