| Task Name | Dataset Name | SOTA Result | Trend | |
|---|---|---|---|---|
| Language Modeling | WikiText-2 | Perplexity (PPL)1.08 | 2,862 | |
| Language Modeling | WikiText-2 | Perplexity3.84 | 205 | |
| Language Modeling | WikiText-2 (val) | Perplexity (BVS)4.73 | 179 | |
| Language modeling | Wikitext-2 | Perplexity (PPL)5.47 | 146 | |
| Text Generation | WikiText-2 | Perplexity4.88 | 138 | |
| Perplexity | WikiText-2 | Perplexity2.81 | 113 | |
| Open-ended text generation | WikiText-2 | COH Score0.811 | 112 | |
| KV Cache Quantization | WikiText-2 prompt 2048-token (train) | Softmax KL Divergence0.0026 | 99 | |
| Language Modeling | WikiText-2 | WikiText-2 Score4.41 | 86 | |
| Language Modeling | WikiText-2 | Average Kurtosis93.039 | 72 | |
| Language Modeling | WikiText-2 | PPL3.52 | 64 | |
| Language Modeling | WikiText-2 raw (test) | Perplexity5.674 | 63 | |
| Language Modeling | WikiText-2 | Perplexity (PPL)5.82 | 40 | |
| Language Modeling | WikiText-2 | Mauve0.9 | 33 | |
| Feature Space Preservation | WikiText-2 | Cosine Similarity100 | 32 | |
| Language Modeling | WikiText-2 context length 2048 (val) | WikiText-2 PPL9.92 | 24 | |
| Language Modeling | WikiText-2 Llama-3.1-8B-Instruct (test) | Perplexity7.2 | 22 | |
| Language Modeling | WikiText-2 v1 (val) | Perplexity42.41 | 20 | |
| Language Modeling | WikiText-2 | Perplexity (PPL)4.91 | 19 | |
| Language Modeling | WikiText-2 10K-word evaluator standardized | PPL Delta (%)11.9 | 18 | |
| Language Modeling | WikiText-2 (val) | PPL (10% sparsity)20 | 17 | |
| Language Modeling | Wikitext-2 v1 (test) | Perplexity (PPL)7.33 | 17 | |
| Language Modeling | Wikitext 2 Llama 2 & 3 (test) | PPL (Llama 2, Config 7)5.47 | 16 | |
| Language Generation | WikiText-2 (test) | Perplexity3.319 | 16 | |
| Text Generation | WikiText-2 | ROUGE-139.1 | 15 |