| Task Name | Dataset Name | SOTA Result | Trend | |
|---|---|---|---|---|
| Classification | bbc | Accuracy99.72 | 61 | |
| Next Token Prediction | BBC | Next Token Accuracy40.05 | 32 | |
| Reference-grounded News Verification | BBC | Classification Accuracy (ACCcls)97.09 | 20 | |
| Topic Modeling | BBC | NPMI0.38 | 17 | |
| Cluster count selection | Bbc | Selected Cluster Count9 | 16 | |
| Multi-view Classification | BBC | Accuracy97.23 | 16 | |
| Topic Modeling | BBC | IRBO1 | 13 | |
| Document Clustering | BBC (test) | NMI0.729 | 13 | |
| Multi-view Clustering | BBC | NMI70.55 | 12 | |
| Dataset Addition | bbc-embedding | DA Score81 | 12 | |
| Dataset Removal | bbc embedding | DR0.9 | 12 | |
| Noisy label detection | bbc-embedding | NLD Score0.11 | 12 | |
| Word Intrusion Detection | BBC | Accuracy63.15 | 10 | |
| Document Classification | BBC | Accuracy100 | 10 | |
| Synthetic Text Generation | BBC | Mean Embedding Similarity0.43 | 10 | |
| Node Classification | BBC rich-text graph (test) | Accuracy98.4 | 10 | |
| Node Classification | BBC (test) | NMI0.949 | 10 | |
| Density Estimation | BBC Randomly-perturbed (test) | Log-likelihood-253.04 | 9 | |
| Density Estimation | BBC Adversarially-perturbed Ta (test) | Log-Likelihood-254.99 | 9 | |
| Multilayer Graph Clustering | BBC | Average Clustering Error13.3 | 8 | |
| Density Estimation | BBC Original T (test) | Log-Likelihood-250.2 | 7 | |
| Corrupted-sample detection | BBC | F1-score85 | 7 | |
| Clustering | Bbc | SIL0.188 | 5 | |
| Clustering | Bbc | AMI83.9 | 5 | |
| Next Token Prediction | BBC | Accuracy (ϵ=∞)25.75 | 5 |