Maximum Total Correlation Reinforcement Learning
Bang You, Puze Liu, Huaping Liu, Jan Peters, Oleg Arenz
2025年份
摘要
RPC LZ-SAC MTC (ours) SAC Action State Figure 1. Maximizing the total correlation within trajectories results in more consistent behavior. As shown in our experiments, this consistency increases robustness to noise and dynamics changes.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了最后一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper18
- CURL: Contrastive Unsupervised Representations for Reinforcement LearningMichael Laskin, Aravind Srinivas, Pieter AbbeelICML 2020 · 被引用 1,261 次
- Improving Sample Efficiency in Model-Free Reinforcement Learning from ImagesDenis Yarats, Amy Zhang, Ilya Kostrikov, Brandon Amos 等AAAI 2021 · 被引用 506 次
- Temporal Difference Learning for Model Predictive ControlNicklas Hansen, Hao Su, Xiaolong WangICML 2022 · 被引用 388 次
- Deep Reinforcement and InfoMax LearningBogdan Mazoure, Remi Tachet des Combes, Thang Doan, Philip Bachman 等NeurIPS 2020 · 被引用 118 次
- BYOL-Explore: Exploration by Bootstrapped PredictionZhaohan Guo, Shantanu Thakoor, Miruna Pislar, Bernardo Ávila Pires 等NeurIPS 2022 · 被引用 104 次
相关 Paper
- Robust Situational Reinforcement Learning in Face of Context DisturbancesJinpeng Zhang, Yufeng Zheng, Chuheng Zhang, Li Zhao 等ICML 2023 · 被引用 5 次
- Latent exploration for Reinforcement LearningAlberto Silvio Chiappa, Alessandro Marin Vargas, Ann Zixiang Huang, Alexander MathisNeurIPS 2023 · 被引用 41 次
- Mind Your Entropy: From Maximum Entropy to Trajectory Entropy-Constrained RLGuojian Zhan, Likun Wang, Pengcheng Wang, Feihong Zhang 等ICML 2026
- Can Agents Run Relay Race with Strangers? Generalization of RL to Out-of-Distribution TrajectoriesLi-Cheng Lan, Huan Zhang, Cho-Jui HsiehICLR 2023 · 被引用 3 次
- Dynamics Are Learned, Not Told: Semi-Supervised Discovery of Latent Dynamics Geometries For Zero-Shot Policy AdaptationZhiming Xu, Weitao Zhou, Xianghui Pan, Nanshan Deng 等ICML 2026
