Value Propagation for Decentralized Networked Deep Multi-agent Reinforcement Learning

Conference on Neural Information Processing Systems (NeurIPS), 2019

Chao Qu, Shie Mannor, Huan Xu, Junwu Xiong, Yuan Qi, Le Song

[PDF]    [Code]