TACTIC: Task-Aware Sparse Coordination Graphs for Multi-Task Multi-agent Reinforcement Learning
Kexing Peng, Pengyi Li, tinghuai ma, Jianye Hao
摘要
Value factorization eases non-stationarity in MARL, but its static coordination assumptions hinder generalization on long-horizon tasks with shifting dependencies. Prior VQ-VAE methods abstract trajectories yet miss time-varying inter-agent dependencies. We present TACTIC, a CTDE framework with three components: (i) VQ-VAE-based trajectory abstraction that learns discrete task-semantic classes; (ii) semantic-conditioned sparse coordination graphs that adapt dependencies by pruning edges according to variance-based pairwise payoff sensitivity; and (iii) a pretrained, frozen trajectory-class predictor that conditions local policies while decoupling task recognition from control. On SMAC and SUMO, TACTIC shows strong overall competitiveness and adaptive coordination under sparse rewards and dynamic task structures.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper13
- QPLEX: Duplex Dueling Multi-Agent Q-LearningJianhao Wang, Zhizhou Ren, Terry Liu, Yang Yu 等ICLR 2021 · 被引用 595 次
- Multi-Agent Game Abstraction via Graph Attention Neural NetworkYong Liu, Weixun Wang, Yujing Hu, Jianye Hao 等AAAI 2020 · 被引用 316 次
- Deep Coordination GraphsWendelin Boehmer, Vitaly Kurin, Shimon WhitesonICML 2020 · 被引用 209 次
- Episodic Multi-agent Reinforcement Learning with Curiosity-driven ExplorationLulu Zheng, Jiarui Chen, Jianhao Wang, Jiamin He 等NeurIPS 2021 · 被引用 126 次
- Agent Modelling under Partial Observability for Deep Reinforcement LearningGeorgios Papoudakis, Filippos Christianos, Stefano V. AlbrechtNeurIPS 2021 · 被引用 110 次
相关 Paper
- Conditional Diffusion Model for Multi-Agent Dynamic Task DecompositionYanda Zhu, Yuanyang Zhu, Daoyi Dong, Caihua Chen 等AAAI 2026
- Agent-Centric Actor-Critic for Asynchronous Multi-Agent Reinforcement LearningWhiyoung Jung, Sunghoon Hong, Deunsol Yoon, Kanghoon Lee 等ICML 2025
- Context-Aware Sparse Deep Coordination GraphsTonghan Wang, Liang Zeng, Weijun Dong, Qianlan Yang 等ICLR 2022 · 被引用 40 次
- Semi-Supervised Generative Models for Multiagent TrajectoriesDennis Fassmeyer, Pascal Fassmeyer, Ulf BrefeldNeurIPS 2022 · 被引用 7 次
- GRDC: A Unified Graph-Driven Framework for Role Discovery and Communication in Multi-Agent Reinforcement LearningZihong Gao, Hongjian Liang, Yuanhui Hao, Lei Hao 等AAAI 2026
