Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Reinforcement Learning Control on ManiSkill stack-cube 2
Loading...
170
Return
Clean
103.44
120.72
138
155.28
Jun 17, 2026
Return
Delta Mean (Ref)
Delta Mean
Delta Distance
Delta Distance (Ref)
Updated 1mo ago
Evaluation Results
Method
Method
Links
Return
Delta Mean (Ref)
Delta Mean
Delta Distance
Delta Distance (Ref)
Clean
2026.06
170
4.4
-
-
-
SWAAP
alpha=0.9, rp=0.1
2026.06
141
-
7.7
4.2
4.1
SWAAP (Random)
alpha=0.9, rp=0.1
2026.06
137
-
8.8
4.2
-
Direct Model Poisoning
2026.06
106
-
11.6
-
-
Feedback
Search any
task
Search any
task