Share your thoughts, 1 month free Claude Pro on usSee more
WorkDL logo mark

LAMBADA

Benchmarks

Task NameDataset NameSOTA ResultTrend
Language ModelingLAMBADA
Accuracy86.9
412
Language ModelingLAMBADA
Perplexity3.1
254
Word PredictionLAMBADA
Accuracy86.9
222
Language ModelingLambada OpenAI
Accuracy78.4
134
Language ModelingLAMBADA
Accuracy79.4
114
Language ModelingLAMBADA (test)
Perplexity4
109
Language ModelingLambada
Perplexity (Lambada)14.36
78
Word PredictionLAMBADA (test)
Accuracy87.15
53
Language ModelingLAMBADA
Accuracy56.2
50
Language ModelingLAMBADA zero-shot (test)
Accuracy (zero-shot)69.12
44
Language ModelingLAMBADA
PPL Change (%)0.2
41
Language ModelingLambada (val)
Perplexity10.14
39
Language ModelingLAMBADA standard (LS)
Accuracy (LAMBADA)73.67
37
Language ModelingLambada Standard
Accuracy60.8
36
Word PredictionLAMBADA OpenAI
Accuracy71.4
29
Language ModelingLAMBADA
Perplexity (PPL)4.11
27
Language ModelingLAMBADA
Delta (%)43.3
25
Reading ComprehensionLambada
Accuracy80.5
24
Language ModelingLambada (OpenAI split)
PPL3.11
22
Language ModelingLAMBADA multilingual (test)
LAMBADA Score (DE)140.97
20
Word PredictionLAMBADA standard
Accuracy65.57
20
Cloze-style completionLambada OpenAI
Accuracy75.65
20
Word PredictionLAMBADA CONTROL (all)
Accuracy36
20
Language ModelingLAMBADA (dev)
Perplexity12.34
20
Commonsense ReasoningLambada
Accuracy66.8
18
Showing 25 of 72 rows