Bridging Imagination and Reality for Model-Based Deep Reinforcement Learning
Guangxiang Zhu, Minghao Zhang, Honglak Lee, Chongjie Zhang
摘要
Sample efficiency has been one of the major challenges for deep reinforcement learning. Recently, model-based reinforcement learning has been proposed to address this challenge by performing planning on imaginary trajectories with a learned world model. However, world model learning may suffer from overfitting to training trajectories, and thus model-based value estimation and policy search will be prone to be sucked in an inferior local policy. In this paper, we propose a novel model-based reinforcement learning algorithm, called BrIdging Reality and Dream (BIRD). It maximizes the mutual information between imaginary and real trajectories so that the policy improvement learned from imaginary trajectories can be easily generalized to real trajectories. We demonstrate that our approach improves sample efficiency of model-based planning, and achieves state-of-the-art performance on challenging visual control benchmarks.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper8
- Flow-based Recurrent Belief State Learning for POMDPsXiaoyu Chen, Yao Mark Mu, Ping Luo, Shengbo Li 等ICML 2022 · 被引用 26 次
- On Effective Scheduling of Model-based Reinforcement LearningHang Lai, Jian Shen, Weinan Zhang, Yimin Huang 等NeurIPS 2021 · 被引用 23 次
- Improving Generalization in Meta-RL with Imaginary Tasks from Latent Dynamics MixtureSuyoung Lee, Sae-Young ChungNeurIPS 2021 · 被引用 23 次
- DMWM: Dual-Mind World Model with Long-Term ImaginationLingyi Wang, Rashed Shelim, Walid Saad, Naren RamakrishnanNeurIPS 2025 · 被引用 15 次
- Model-Based Reinforcement Learning via Imagination with Derived MemoryYao Mu, Yuzheng Zhuang, Bin Wang, Guangxiang Zhu 等NeurIPS 2021 · 被引用 14 次
它引用的顶会 Paper3
- Dream to Control: Learning Behaviors by Latent ImaginationDanijar Hafner, Timothy P. Lillicrap, Jimmy Ba, Mohammad NorouziICLR 2020 · 被引用 1,852 次
- Model Based Reinforcement Learning for AtariLukasz Kaiser, Mohammad Babaeizadeh, Piotr Milos, Blazej Osinski 等ICLR 2020 · 被引用 969 次
- On Mutual Information Maximization for Representation LearningMichael Tschannen, Josip Djolonga, Paul K. Rubenstein, Sylvain Gelly 等ICLR 2020 · 被引用 559 次
相关 Paper
- DreamSmooth: Improving Model-based Reinforcement Learning via Reward SmoothingVint Lee, Pieter Abbeel, Youngwoon LeeICLR 2024 · 被引用 10 次
- Learning to Reweight Imaginary Transitions for Model-Based Reinforcement LearningWenzhen Huang, Qiyue Yin, Junge Zhang, Kaiqi HuangAAAI 2021 · 被引用 3 次
- On the Feasibility of Cross-Task Transfer with Model-Based Reinforcement LearningYifan Xu, Nicklas Hansen, Zirui Wang, Yung-Chieh Chan 等ICLR 2023 · 被引用 3 次
- TaskLoom: Weaving Knowledge Across Tasks in World ModelsQingzhang Zeng, Peixi Peng, hang li, Luntong Li 等ICML 2026
- HarmonyDream: Task Harmonization Inside World ModelsHaoyu Ma, Jialong Wu, Ningya Feng, Chenjun Xiao 等ICML 2024 · 被引用 21 次
