Wasserstein Gradient Flows for Optimizing Gaussian Mixture Policies
Hanna Ziesche, Leonel Rozo
Abstract
Robots often rely on a repertoire of previously-learned motion policies for performing tasks of diverse complexities. When facing unseen task conditions or when new task requirements arise, robots must adapt their motion policies accordingly. In this context, policy optimization is the de facto paradigm to adapt robot policies as a function of task-specific objectives. Most commonly-used motion policies carry particular structures that are often overlooked in policy optimization algorithms. We instead propose to leverage the structure of probabilistic policies by casting the policy optimization as an optimal transport problem. Specifically, we focus on robot motion policies that build on Gaussian mixture models (GMMs) and formulate the policy optimization as a Wassertein gradient flow over the GMMs space. This naturally allows us to constrain the policy updates via the L 2 -Wasserstein distance between GMMs to enhance the stability of the policy optimization process. Furthermore, we leverage the geometry of the Bures-Wasserstein manifold to optimize the Gaussian distributions of the GMM policy via Riemannian optimization. We evaluate our approach on common robotic settings: Reaching motions, collision-avoidance behaviors, and multi-goal tasks. Our results show that our method outperforms common policy optimization baselines in terms of task success rate and low-variance solutions. Preprint. Under review.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 47ab3692-4aed-41ed-8888-da976bfd20d6Cited by top-tier papers3
- SAC Flow: Sample-Efficient Reinforcement Learning of Flow-Based Policies via Velocity-Reparameterized Sequential ModelingYixian Zhang, Shu'ang Yu, Tonghe Zhang, Mo Guang et al.ICLR 2026 · 33 citations
- Slicing Wasserstein over Wasserstein via Functional Optimal TransportMoritz Piening, Robert BeinertICLR 2026 · 5 citations
- Learning Anisotropic Value Geometry with Finsler Reinforcement LearningJumman Hossain, Nirmalya RoyICML 2026
Builds on7
- Maximum Entropy RL (Provably) Solves Some Robust RL ProblemsBenjamin Eysenbach, Sergey LevineICLR 2022 · 244 citations
- Large-Scale Wasserstein Gradient FlowsPetr Mokrov, Alexander Korotin, Lingxiao Li, Aude Genevay et al.NeurIPS 2021 · 112 citations
- Neural Dynamic Policies for End-to-End Sensorimotor LearningShikhar Bahl, Mustafa Mukadam, Abhinav Gupta, Deepak PathakNeurIPS 2020 · 97 citations
- On Riemannian Optimization over Positive Definite Matrices with the Bures-Wasserstein GeometryAndi Han, Bamdev Mishra, Pratik Kumar Jawanpuria, Junbin GaoNeurIPS 2021 · 55 citations
- Learning to Score Behaviors for Guided Policy OptimizationAldo Pacchiano, Jack Parker-Holder, Yunhao Tang, Krzysztof Choromanski et al.ICML 2020 · 42 citations
Related papers
- Flowing Datasets with Wasserstein over Wasserstein Gradient FlowsClément Bonet, Christophe Vauthier, Anna KorbaICML 2025
- Trust Region Policy Optimization with Optimal Transport Discrepancies: Duality and Algorithm for Continuous ActionsAntonio Terpin, Nicolas Lanzetti, Batuhan Yardim, Florian Dörfler et al.NeurIPS 2022 · 14 citations
- Continuous-time Riemannian SGD and SVRG Flows on Wasserstein Probabilistic SpaceMingyang Yi, Bohan WangNeurIPS 2025
- Accelerating Motion Planning via Optimal TransportAn T. Le, Georgia Chalvatzaki, Armin Biess, Jan PetersNeurIPS 2023 · 30 citations
- Riemannian Convex Potential MapsSamuel Cohen, Brandon Amos, Yaron LipmanICML 2021 · 24 citations
