Recursive Reasoning Graph for Multi-Agent Reinforcement Learning
Xiaobai Ma, David Isele, Jayesh K. Gupta, Kikuo Fujimura, Mykel J. Kochenderfer
摘要
Multi-agent reinforcement learning (MARL) provides an efficient way for simultaneously learning policies for multiple agents interacting with each other. However, in scenarios requiring complex interactions, existing algorithms can suffer from an inability to accurately anticipate the influence of self-actions on other agents. Incorporating an ability to reason about other agents' potential responses can allow an agent to formulate more effective strategies. This paper adopts a recursive reasoning model in a centralized-training-decentralized-execution framework to help learning agents better cooperate with or compete against others. The proposed algorithm, referred to as the Recursive Reasoning Graph (R2G), shows state-of-the-art performance on multiple multi-agent particle and robotics games.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper1
相关 Paper
- Reinforcement Learning under a Multi-agent Predictive State Representation Model: Method and TheoryZhi Zhang, Zhuoran Yang, Han Liu, Pratap Tokekar 等ICLR 2022 · 被引用 10 次
- R2-B2: Recursive Reasoning-Based Bayesian Optimization for No-Regret Learning in GamesZhongxiang Dai, Yizhou Chen, Bryan Kian Hsiang Low, Patrick Jaillet 等ICML 2020 · 被引用 28 次
- Multi-Agent Actor-Critic with Hierarchical Graph Attention NetworkHeechang Ryu, Hayong Shin, Jinkyoo ParkAAAI 2020 · 被引用 143 次
- Mimicking To Dominate: Imitation Learning Strategies for Success in Multiagent GamesThe Viet Bui, Tien Mai, Thanh Hong NguyenNeurIPS 2024 · 被引用 5 次
- Policy Gradient With Serial Markov Chain ReasoningEdoardo Cetin, Oya ÇeliktutanNeurIPS 2022 · 被引用 4 次
