Chao Li, Yujing Hu, Pinzhuo Tian, Shaokang Dong, Yang Gao: DDMA: Discrepancy-Driven Multi-agent Reinforcement Learning. PRICAI (3) 2022: 91-105