Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Multi-agent Reinforcement Learning on MaMuJoCo OMIGA 2-Ant (Medium-Expert)
Loading...
2,002
Average Episode Reward
OMSD
-3,192.592
-1,843.996
-495.4
853.196
May 9, 2025
Jul 15, 2025
Sep 21, 2025
Nov 28, 2025
Feb 3, 2026
Apr 12, 2026
Jun 19, 2026
Average Episode Reward
Updated 1mo ago
Evaluation Results
Method
Method
Links
Average Episode Reward
OMSD
2025.05
2,002
OMIGA
2025.05
1,720.33
Sim2O
Steps=1 million
2026.06
1,689.52
PEX-MA
Steps=1 million
2026.06
1,650.58
RLPD-MA
Steps=1 million
2026.06
1,605.23
ICQ
2025.05
1,590.18
AWAC-MA
Steps=1 million
2026.06
1,566.56
PROTO-MA
Steps=1 million
2026.06
1,269.24
BCQMA
2025.05
1,020.89
CQLMA
2025.05
800.22
OMAR
2025.05
-2,992.8
Feedback
Search any
task
Search any
task