Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Reinforcement Learning Surrogate Modeling on InvertedDoublePendulum (IDP) (test)
Loading...
103
Reward Ratio (%)
ORCAID
1.08
27.54
54
80.46
Jul 8, 2026
Reward Ratio (%)
MSE (Test)
Updated 17d ago
Evaluation Results
Method
Method
Links
Reward Ratio (%)
MSE (Test)
ORCAID
MD=3, Model Size=146±4
2026.07
103
0.012
Cubist
MNR=120, Model Size=15...
2026.07
69
0.012
RuleFit
MNR=27, Model Size=94±12
2026.07
7
0.043
Decision Tree
MD=16, Model Size=4147±88
2026.07
5
0.042
Feedback
Search any
task
Search any
task