f-GAIL: Learning f-Divergence for Generative Adversarial Imitation Learning
Xin Zhang, Yanhua Li, Ziming Zhang, Zhi-Li Zhang
摘要
Imitation learning (IL) aims to learn a policy from expert demonstrations that minimizes the discrepancy between the learner and expert behaviors. Various imitation learning algorithms have been proposed with different pre-determined divergences to quantify the discrepancy. This naturally gives rise to the following question: Given a set of expert demonstrations, which divergence can recover the expert policy more accurately with higher data efficiency? In this work, we propose -GAIL, a new generative adversarial imitation learning (GAIL) model, that automatically learns a discrepancy measure from the -divergence family as well as a policy capable of producing expert-like behaviors. Compared with IL baselines with various predefined divergence measures, -GAIL learns better policies with higher data efficiency in six physics-based control tasks.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper4
- Planning for Sample Efficient Imitation LearningZhao-Heng Yin, Weirui Ye, Qifeng Chen, Yang GaoNeurIPS 2022 · 被引用 32 次
- DiffAIL: Diffusion Adversarial Imitation LearningBingzheng Wang, Guoqiang Wu, Teng Pang, Yan Zhang 等AAAI 2024 · 被引用 24 次
- Inverse Contextual Bandits: Learning How Behavior Evolves over TimeAlihan Hüyük, Daniel Jarrett, Mihaela van der SchaarICML 2022 · 被引用 14 次
- FedSkill: Privacy Preserved Interpretable Skill Learning via ImitationYushan Jiang, Wenchao Yu, Dongjin Song, Lu Wang 等KDD 2023 · 被引用 5 次
它引用的顶会 Paper1
相关 Paper
- Learning to Weight Imperfect DemonstrationsYunke Wang, Chang Xu, Bo Du, Honglak LeeICML 2021 · 被引用 57 次
- Diffusion-Reward Adversarial Imitation LearningChun-Mao Lai, Hsiang-Chun Wang, Ping-Chun Hsieh, Yu-Chiang Frank Wang 等NeurIPS 2024 · 被引用 28 次
- C-GAIL: Stabilizing Generative Adversarial Imitation Learning with Control TheoryTianjiao Luo, Tim Pearce, Huayu Chen, Jianfei Chen 等NeurIPS 2024 · 被引用 13 次
- Variational Adversarial Kernel Learned Imitation LearningFan Yang, Alina Vereshchaka, Yufan Zhou, Changyou Chen 等AAAI 2020 · 被引用 9 次
- Exploring Gradient Explosion in Generative Adversarial Imitation Learning: A Probabilistic PerspectiveWanying Wang, Yichen Zhu, Yirui Zhou, Chaomin Shen 等AAAI 2024 · 被引用 13 次
