ADAPT: Adaptive Decentralized Architecture with Perception-Aligned Training for Structural Generalization in Multi-Agent RL
Zhixiang Zhang, Shuo Chen, Yexin Li, Feng Wang
摘要
Multi-agent reinforcement learning (MARL) excels in cooperative and competitive tasks, but most architectures are tied to fixed input-output sizes and require retraining when the number of perceptible or controllable objects changes. While structural generalization techniques mitigate this, they rely on centralized training, raising concerns about scalability and privacy. We propose ADAPT, the first framework to support structural generalization under a decentralized training and decentralized execution (DTDE) paradigm. Every agent adopts an object-centric view, encoding each observed object into a feature vector and aggregating them into a variable-length set representation. To enable each agent to infer task-level contexts from this dynamic input independently, we propose a dynamic-consistency loss that enforces spatio-temporal alignment between context representations and observed environmental dynamics. Agents then condition their policies on the inferred contexts to make locally aligned decisions. For zero-shot transfer, we propose FINE (Foresight INdex for multi-agEnt), a metric that considers Q-value overestimation and enables cross-policy comparison of long-term impact, facilitating effective policy transfer. Experiments show that ADAPT surpasses existing DTDE methods and outperforms CTDE baselines in zero-shot generalization.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper3
- Randomized Entity-wise Factorization for Multi-Agent Reinforcement LearningShariq Iqbal, Christian A. Schröder de Witt, Bei Peng, Wendelin Boehmer 等ICML 2021 · 被引用 84 次
- UPDeT: Universal Multi-agent RL via Policy Decoupling with TransformersSiyi Hu, Fengda Zhu, Xiaojun Chang, Xiaodan LiangICLR 2021 · 被引用 49 次
- FlickerFusion: Intra-trajectory Domain Generalizing Multi-agent Reinforcement LearningWoosung Koh, Wonbeen Oh, Siyeol Kim, Suhin Shin 等ICLR 2025
相关 Paper
- Decompose a Task into Generalizable Subtasks in Multi-Agent Reinforcement LearningZikang Tian, Ruizhi Chen, Xing Hu, Ling Li 等NeurIPS 2023 · 被引用 23 次
- Multi-agent In-context Coordination via Decentralized Memory RetrievalTao Jiang, Zichuan Lin, Lihe Li, Yi-Chen Li 等AAAI 2026 · 被引用 1 次
- Self-Organized Group for Cooperative Multi-agent Reinforcement LearningJianzhun Shao, Zhiqiang Lou, Hongchang Zhang, Yuhang Jiang 等NeurIPS 2022 · 被引用 41 次
- Role-Level Inductive Bias for Cross-Task Generalization in Multi-Agent Reinforcement LearningChang Yao, Youfang Lin, Shoucheng Song, Hao Wu 等ICML 2026
- Consensus Learning for Cooperative Multi-Agent Reinforcement LearningZhiwei Xu, Bin Zhang, Dapeng Li, Zeren Zhang 等AAAI 2023 · 被引用 27 次
