Book
Open access
Jul 2026
Combining Policy Gradients with Quality-Diversity in Cooperative Multi-Agent Reinforcement Learning
MAPGA-ME is proposed, a multi-agent extension of PGA-MAP-Elites that integrates policy gradient updates into MAP-Elites for cooperative control and identifies key factors affecting the effectiveness of policy gradient-based QD in multi-agent learning.
Hai D. Pham, N. Luong
· GECCO Companion · 0 citations