| Task Name | Dataset Name | SOTA Result | Trend | |
|---|---|---|---|---|
| Game Solving | Wordle (test) | Success Rate32 | 25 | |
| One-step next-observation prediction | Wordle (test) | Token F10.72 | 16 | |
| Reinforcement Learning | Wordle OOD-1 | Cumulative Reward5.07 | 3 | |
| In-context adaptation | Wordle | Cumulative Reward6.23 | 3 |