Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Reinforcement Learning Control on DMControl dog-walk
Loading...
798
Return
Clean
512
586.25
660.5
734.75
Jun 17, 2026
Return
Delta M Ref
Delta M
Delta D
Delta D Ref
Updated 1mo ago
Evaluation Results
Method
Method
Links
Return
Delta M Ref
Delta M
Delta D
Delta D Ref
Clean
2026.06
798
5.6
-
-
-
SWAAP (Random)
alpha=0.9, rp=0.1
2026.06
794
-
5.5
5.9
-
SWAAP
alpha=0.9, rp=0.1
2026.06
748
-
6.1
6
5.9
Direct Model Poisoning
2026.06
523
-
8.6
-
-
Feedback
Search any
task
Search any
task