MetaLight: Value-Based Meta-Reinforcement Learning for Traffic Signal Control
Xinshi Zang, Huaxiu Yao, Guanjie Zheng, Nan Xu, Kai Xu, Zhenhui Li
摘要
Using reinforcement learning for traffic signal control has attracted increasing interests recently. Various value-based reinforcement learning methods have been proposed to deal with this classical transportation problem and achieved better performances compared with traditional transportation methods. However, current reinforcement learning models rely on tremendous training data and computational resources, which may have bad consequences (e.g., traffic jams or accidents) in the real world. In traffic signal control, some algorithms have been proposed to empower quick learning from scratch, but little attention is paid to learning by transferring and reusing learned experience. In this paper, we propose a novel framework, named as MetaLight, to speed up the learning process in new scenarios by leveraging the knowledge learned from existing scenarios. MetaLight is a value-based meta-reinforcement learning workflow based on the representative gradient-based meta-learning algorithm (MAML), which includes periodically alternate individual-level adaptation and global-level adaptation. Moreover, MetaLight improves the-state-of-the-art reinforcement learning model FRAP in traffic signal control by optimizing its model structure and updating paradigm. The experiments on four real-world datasets show that our proposed MetaLight not only adapts more quickly and stably in new traffic scenarios, but also achieves better performance.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper10
- AttendLight: Universal Attention-Based Reinforcement Learning Model for Traffic Signal ControlAfshin Oroojlooy, MohammadReza Nazari, Davood Hajinezhad, Jorge SilvaNeurIPS 2020 · 被引用 143 次
- Hierarchically and Cooperatively Learning Traffic Signal ControlBingyu Xu, Yaowei Wang, Zhaozhi Wang, Huizhu Jia 等AAAI 2021 · 被引用 88 次
- Prompt to Transfer: Sim-to-Real Transfer for Traffic Signal Control with Prompt LearningLongchao Da, Minquan Gao, Hao Mei, Hua WeiAAAI 2024 · 被引用 60 次
- EMVLight: A Decentralized Reinforcement Learning Framework for Efficient Passage of Emergency VehiclesHaoran Su, Yaofeng Desmond Zhong, Biswadip Dey, Amit ChakrabortyAAAI 2022 · 被引用 29 次
- DiffLight: A Partial Rewards Conditioned Diffusion Model for Traffic Signal Control with Missing DataHanyang Chen, Yang Jiang, Shengnan Guo, Xiaowei Mao 等NeurIPS 2024 · 被引用 18 次
相关 Paper
- CrossLight: Offline-to-Online Reinforcement Learning for Cross-City Traffic Signal ControlQian Sun, Rui Zha, Le Zhang, Jingbo Zhou 等KDD 2024 · 被引用 9 次
- FedLight: Federated Reinforcement Learning for Autonomous Multi-Intersection Traffic Signal ControlYutong Ye, Wupan Zhao, Tongquan Wei, Shiyan Hu 等DAC 2021 · 被引用 26 次
- Expression might be enough: representing pressure and demand for reinforcement learning based traffic signal controlLiang Zhang, Qiang Wu, Jun Shen, Linyuan Lü 等ICML 2022 · 被引用 57 次
- TransformerLight: A Novel Sequence Modeling Based Traffic Signaling Mechanism via Gated TransformerQiang Wu, Mingyuan Li, Jun Shen, Linyuan Lü 等KDD 2023 · 被引用 17 次
- Mitigating Action Hysteresis in Traffic Signal Control with Traffic Predictive Reinforcement LearningXiao Han, Xiangyu Zhao, Liang Zhang, Wanyu WangKDD 2023 · 被引用 16 次
