Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Offline Safe Reinforcement Learning on DSRL HardDense
Loading...
243.63
Reward
CDCP
-12.4076
54.0637
120.535
187.0063
Jul 4, 2026
Reward
Cost
Updated 19d ago
Evaluation Results
Method
Method
Links
Reward
Cost
CDCP
Mode=Multi-task
2026.07
243.63
24.43
MTCOptiDICE
Mode=Multi-task
2026.07
106.05
22.18
MTCDT
Mode=Multi-task
2026.07
86.34
16.88
MTCPQ
Mode=Multi-task
2026.07
-2.56
0.33
Feedback
Search any
task
Search any
task