Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Reinforcement Learning Surrogate Modeling on LunarLander (LL) (test)
Loading...
90
Reward Ratio
ORCAID
36.96
50.73
64.5
78.27
Jul 8, 2026
Reward Ratio
MSE (x10^-3)
Updated 17d ago
Evaluation Results
Method
Method
Links
Reward Ratio
MSE (x10^-3)
ORCAID
MD=4, Model Size=316±5
2026.07
90
71
Cubist
MNR=50, Model Size=1161±9
2026.07
88
64
RuleFit
MNR=21, Model Size=137±10
2026.07
79
100
Decision Tree
MD=14, Model Size=4099±75
2026.07
39
102
Feedback
Search any
task
Search any
task