Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Offline Reinforcement Learning on D4RL Walker-2D risk-sensitive Mixed
Loading...
531
CVaR 0.1
RS-Diffuser
55.72
179.11
302.5
425.89
Jun 26, 2026
CVaR 0.1
Mean Return
Updated 27d ago
Evaluation Results
Method
Method
Links
CVaR 0.1
Mean Return
RS-Diffuser
2026.06
531
377
UDAC
2026.06
498
299
CODAC
2026.06
450
261
Diffusion-QL
2026.06
302
102
ORAAC
2026.06
222
-70
OWCPG
2026.06
201
-77
CQL
2026.06
74
-64
Feedback
Search any
task
Search any
task