Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Multi-agent Reinforcement Learning on MaMuJoCo OMIGA 6-HalfCheetah (Medium-Replay)
Loading...
4,582
Avg Episode Reward
OMSD
-530.2656
796.9572
2,124.18
3,451.4028
May 9, 2025
Jul 15, 2025
Sep 21, 2025
Nov 28, 2025
Feb 3, 2026
Apr 12, 2026
Jun 19, 2026
Avg Episode Reward
Updated 1mo ago
Evaluation Results
Method
Method
Links
Avg Episode Reward
OMSD
2025.05
4,582
Sim2O
Steps=1 million
2026.06
3,145.98
PEX-MA
Steps=1 million
2026.06
2,850.57
AWAC-MA
Steps=1 million
2026.06
2,550.09
OMIGA
2025.05
2,504.7
RLPD-MA
Steps=1 million
2026.06
2,488.39
PROTO-MA
Steps=1 million
2026.06
2,327.58
CQLMA
2025.05
1,998.67
ICQ
2025.05
1,922.42
OMAR
2025.05
-235.42
BCQMA
2025.05
-333.64
Feedback
Search any
task
Search any
task