Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Reinforcement Learning on MountainCar (Return Mean and Std)
Loading...
-41.98
Return (Selected)
FPSRL
-43.5296
-43.1273
-42.725
-42.3227
Oct 19, 2016
Return (Selected)
Return (Mean)
Return (Std)
Updated 1mo ago
Evaluation Results
Method
Method
Links
Return (Selected)
Return (Mean)
Return (Std)
FPSRL
Batch size=1,000
2016.10
-41.98
-41.99
0.01
FPSRL
Batch size=100,000
2016.10
-41.99
-41.93
0.11
FPSRL
Batch size=10,000
2016.10
-42.22
-42.69
0.46
NFQ
Batch size=100,000
2016.10
-43.12
-43.28
1.22
NFQ
Batch size=1,000
2016.10
-43.23
-44.87
1.33
NFQ
Batch size=10,000
2016.10
-43.47
-45.73
2.9
Feedback
Search any
task
Search any
task