Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Offline Reinforcement Learning on D4RL Walker-2D risk-sensitive Expert
Loading...
1,406
CVaR 0.1
RS-Diffuser
320.24
602.12
884
1,165.88
Jun 26, 2026
CVaR 0.1
Mean Score
Updated 27d ago
Evaluation Results
Method
Method
Links
CVaR 0.1
Mean Score
RS-Diffuser
2026.06
1,406
2,204
UDAC
2026.06
1,398
2,198
CQL
2026.06
1,301
2,018
CODAC
2026.06
1,298
2,102
ORAAC
2026.06
1,172
2,006
Diffusion-QL
2026.06
621
1,202
OWCPG
2026.06
362
1,372
Feedback
Search any
task
Search any
task