Hierarchical Planning and Learning for Robots in Stochastic Settings Using Zero-Shot Option Invention
Naman Shah, Siddharth Srivastava
摘要
This paper addresses the problem of inventing and using hierarchical representations for stochastic robot-planning problems. Rather than using hand-coded state or action representations as input, it presents new methods for learning how to create a generalizable high-level action representation for long-horizon, sparse reward robot planning problems in stochastic settings with unknown dynamics. After training, this system yields a robot-class-specific but environment independent planning system that generalizes to different robots, environments, and problem instances. Given new problem instances in unseen stochastic environments, it first creates zero-shot options (without any experience on the new environment) with dense pseudo-rewards and then uses them to solve the input problem in a hierarchical planning and refinement process. Theoretical results identify sufficient conditions for completeness of the presented approach. Extensive empirical analysis shows that even in settings that go beyond these sufficient conditions, this approach convincingly outperforms baselines by 2× in terms of solution time with orders of magnitude improvement in solution quality.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper2
- Autonomous Option Invention for Continual Hierarchical Reinforcement Learning and PlanningRashmeet Kaur Nayyar, Siddharth SrivastavaAAAI 2025 · 被引用 7 次
- Context-Sensitive Abstractions for Reinforcement Learning with Parameterized ActionsRashmeet Kaur Nayyar, Naman Shah, Siddharth SrivastavaAAAI 2026
它引用的顶会 Paper5
- Option Discovery using Deep Skill ChainingAkhil Bagaria, George KonidarisICLR 2020 · 被引用 126 次
- Landmark-Guided Subgoal Generation in Hierarchical Reinforcement LearningJunsu Kim, Younggyo Seo, Jinwoo ShinNeurIPS 2021 · 被引用 90 次
- Skill Discovery for Exploration and Planning using Deep Skill GraphsAkhil Bagaria, Jason K. Senthil, George KonidarisICML 2021 · 被引用 73 次
- Sub-Goal Trees a Framework for Goal-Based Reinforcement LearningTom Jurgenson, Or Avner, Edward Groshev, Aviv TamarICML 2020 · 被引用 48 次
- Subgoal Search For Complex Reasoning TasksKonrad Czechowski, Tomasz Odrzygózdz, Marek Zbysinski, Michal Zawalski 等NeurIPS 2021 · 被引用 41 次
相关 Paper
- Hierarchical Reinforcement Learning by Discovering Intrinsic OptionsJesse Zhang, Haonan Yu, Wei XuICLR 2021 · 被引用 97 次
- Consciousness-Inspired Spatio-Temporal Abstractions for Better Generalization in Reinforcement LearningHarry Zhao, Safa Alver, Harm van Seijen, Romain Laroche 等ICLR 2024 · 被引用 5 次
- Active Hierarchical Exploration with Stable Subgoal Representation LearningSiyuan Li, Jin Zhang, Jianhao Wang, Yang Yu 等ICLR 2022 · 被引用 28 次
- Zero-Shot Trajectory Planning for Signal Temporal Logic TasksRuijia Liu, Ancheng Hou, Xiao Yu, Xiang YinNeurIPS 2025 · 被引用 14 次
- PDSketch: Integrated Domain Programming, Learning, and PlanningJiayuan Mao, Tomás Lozano-Pérez, Josh Tenenbaum, Leslie Pack KaelblingNeurIPS 2022 · 被引用 40 次
