| Task Name | Dataset Name | SOTA Result | Trend | |
|---|---|---|---|---|
| Off-policy Evaluation | D4RL Half Cheetah Synthetic via VAE (test) | Confidence Interval1,820.79 | 8 | |
| Offline Reinforcement Learning | risk-sensitive D4RL Half-Cheetah Mixed | CVaR 0.1301 | 7 | |
| Offline Reinforcement Learning | D4RL Half-Cheetah risk-sensitive Expert | CVaR (0.1)793 | 7 | |
| Offline Reinforcement Learning | D4RL Half-Cheetah risk-sensitive Medium | CVaR 0.1292 | 7 |