Share your thoughts, 1 month free Claude Pro on us
See more
Home
/
Benchmarks
Multi-agent reinforcement learning on CC4
Loading...
2,110
Reward
FULLOBS
945.2
1,247.6
1,550
1,852.4
Jun 28, 2026
Reward
Cost (KB)
Updated 25d ago
Evaluation Results
Method
Method
Links
Reward
Cost (KB)
FULLOBS
Algorithm=MAPPO
2026.06
2,110
8,420.6
HICOMM
Algorithm=MAPPO
2026.06
1,941
7.7
FULLOBS
Algorithm=IPPO
2026.06
1,763
8,420.6
CACOM
Algorithm=MAPPO
2026.06
1,692
36.8
T2MAC
Algorithm=IPPO
2026.06
1,623
143.8
T2MAC
Algorithm=MAPPO
2026.06
1,554
134.2
HICOMM
Algorithm=IPPO
2026.06
1,527
8.4
CACOM
Algorithm=IPPO
2026.06
1,517
41.3
PARTIALOBS
Algorithm=IPPO
2026.06
1,436
0
PARTIALOBS
Algorithm=MAPPO
2026.06
990
0
Feedback
Search any
task
Search any
task