Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Offline Safe Reinforcement Learning on DSRL EasyDense
Loading...
316.47
Reward
CDCP
-15.7476
70.5012
156.75
242.9988
Jul 4, 2026
Reward
Cost
Updated 19d ago
Evaluation Results
Method
Method
Links
Reward
Cost
CDCP
Mode=Multi-task
2026.07
316.47
24.39
MTCOptiDICE
Mode=Multi-task
2026.07
208.75
47.19
MTCDT
Mode=Multi-task
2026.07
155.48
30.82
MTCPQ
Mode=Multi-task
2026.07
-2.97
0.33
Feedback
Search any
task
Search any
task