ACE: Cooperative Multi-agent Q-learning with Bidirectional Action-Dependency

Benchmark Model Rank Results
smac-on-smac-3s5z-vs-3s6zACE#1Median Win Rate: 100
smac-on-smac-6h-vs-8zACE#1Median Win Rate: 93.75
smac-on-smac-corridorACE#1Median Win Rate: 100
smac-on-smac-mmm2ACE#1Median Win Rate: 100