Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Reinforcement Learning Surrogate Modeling on Hopper H (test)
Loading...
89
Reward Ratio
ORCAID
14.12
33.56
53
72.44
Jul 8, 2026
Reward Ratio
MSE (Test, x10^-3)
Updated 17d ago
Evaluation Results
Method
Method
Links
Reward Ratio
MSE (Test, x10^-3)
ORCAID
MD=4, Model Size=720±10
2026.07
89
0.051
Cubist
MNR=20, Model Size=850±6
2026.07
86
0.046
RuleFit
MNR=28, Model Size=287±7
2026.07
85
0.077
Decision Tree
MD=18, Model Size=4238±67
2026.07
17
0.056
Feedback
Search any
task
Search any
task