Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Offline Reinforcement Learning on D4RL Walker-2D Medium (Risk-Sensitive)
Loading...
1,493
CVaR 0.1
RS-Diffuser
-75.32
331.84
739
1,146.16
Jun 26, 2026
CVaR 0.1
Mean Return
Updated 27d ago
Evaluation Results
Method
Method
Links
CVaR 0.1
Mean Return
RS-Diffuser
2026.06
1,493
1,588
UDAC
2026.06
1,368
1,602
CQL
2026.06
1,244
1,524
CODAC
2026.06
1,159
1,537
ORAAC
2026.06
663
1,134
Diffusion-QL
2026.06
31
273
OWCPG
2026.06
-15
283
Feedback
Search any
task
Search any
task