The Lie We Tell: Correcting the Euclidean Fallacy in Vision Language Action Policies via Score Matching on Tangent Space
Bing-Cheng Chuang, I-Hsuan Chu, Bor Jiun Lin, Yang YuanFu, Min Sun, Chun-Yi Lee
Abstract
Diffusion-based Vision-Language-Action policies achieve remarkable success in robotic manipulation, yet commit a fundamental geometric error we term the Euclidean Fallacy: representing SE(3) poses as flat vectors. This approximation induces (1) manifold drift violating SO(3) constraints, (2) broken equivariance under coordinate transformations, and (3) non-geodesic trajectories with excessive kinematic cost. We introduce Lie Diffuser Actor (LDA), a diffusion framework operating intrinsically on SE(3). Our method injects noise through left-invariant SDEs, predicts scores in the tangent space, and retracts samples via the exponential map. This formulation eliminates manifold drift by construction while guaranteeing coordinate-frame equivariance and geodesic optimality. On CALVIN ABCD, LDA improves average task length from to (). We further validate our method on real robot and the results show that our methodology outperforms the baseline on majority tasks.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 2b84d65b-3d6e-4337-880b-103b984d557bBuilds on10
- Learning Transferable Visual Models From Natural Language SupervisionAlec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh et al.ICML 2021 · 47,906 citations
- Riemannian Score-Based Generative ModellingValentin De Bortoli, Emile Mathieu, Michael J. Hutchinson, James Thornton et al.NeurIPS 2022 · 306 citations
- HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action ModelJiaming Liu, Hao Chen, Zhuoyang Liu, Pengju An et al.ICLR 2026 · 216 citations
- Flow Matching on General GeometriesRicky T. Q. Chen, Yaron LipmanICLR 2024 · 193 citations
- Theseus: A Library for Differentiable Nonlinear OptimizationLuis Pineda, Taosha Fan, Maurizio Monge, Shobha Venkataraman et al.NeurIPS 2022 · 124 citations
Related papers
- SE(3)-Equivariant Diffusion Policy in Spherical Fourier SpaceXupeng Zhu, Fan Wang, Robin Walters, Jane ShiICML 2025
- Et-Seed: Efficient trajectory-Level SE(3) equivariant diffusion PolicyChenrui Tie, Yue Chen, Ruihai Wu, Boxuan Dong et al.ICLR 2025
- A Primer on SO(3) Action Representations in Deep Reinforcement LearningMartin Schuck, Sherif Samy, Angela P. SchoelligICLR 2026 · 2 citations
- EquAct: An SE(3)-Equivariant Multi-Task Transformer for 3D Robotic ManipulationXupeng Zhu, Yu Qi, Yizhe Zhu, Robin Walters et al.ICLR 2026 · 9 citations
- PDFactor: Learning Tri-Perspective View Policy Diffusion Field for Multi-Task Robotic ManipulationJingyi Tian, Le Wang, Sanping Zhou, Sen Wang et al.CVPR 2025
