| Task Name | Dataset Name | SOTA Result | Trend | |
|---|---|---|---|---|
| Navigation | DoorKey 8x8 100 episodes (test) | Reward91 | 7 | |
| Reinforcement Learning | DoorKey | Reward0.97 | 7 | |
| Reinforcement Learning | DoorKey 6x6 (train) | Mean Episodic Return0.744 | 5 | |
| Extrapolation performance | DoorKey (test) | Accuracy100 | 4 | |
| MDP Abstraction | DoorKey | Compression Rate100 | 3 | |
| Extrapolation | DoorKey 256x256 (test) | Accuracy100 | 2 | |
| Extrapolation | Doorkey | Accuracy100 | 2 |