Equivariance-aware Architectural Optimization of Neural Networks
Kaitlin Maile, Dennis George Wilson, Patrick Forré
Abstract
Incorporating equivariance to symmetry groups as a constraint during neural network training can improve performance and generalization for tasks exhibiting those symmetries, but such symmetries are often not perfectly nor explicitly present. This motivates algorithmically optimizing the architectural constraints imposed by equivariance. We propose the equivariance relaxation morphism, which preserves functionality while reparameterizing a group equivariant layer to operate with equivariance constraints on a subgroup, as well as the [G]-mixed equivariant layer, which mixes layers constrained to different groups to enable within-layer equivariance optimization. We further present evolutionary and differentiable neural architecture search (NAS) algorithms that utilize these mechanisms respectively for equivariance-aware architectural optimization. Experiments across a variety of datasets show the benefit of dynamically constrained equivariance to find effective architectures with approximate equivariance.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Cited by top-tier papers6
- Improving Equivariant Model Training via Constraint RelaxationStefanos Pertigkiozoglou, Evangelos Chatzipantazis, Shubhendu Trivedi, Kostas DaniilidisNeurIPS 2024 · 26 citations
- A General Theory of Correct, Incorrect, and Extrinsic EquivarianceDian Wang, Xupeng Zhu, Jung Yeon Park, Mingxi Jia et al.NeurIPS 2023 · 23 citations
- A Generative Model of Symmetry TransformationsJames Urquhart Allingham, Bruno Mlodozeniec, Shreyas Padhy, Javier Antorán et al.NeurIPS 2024 · 16 citations
- Efficient Equivariant Transfer Learning from Pretrained ModelsSourya Basu, Pulkit Katdare, Prasanna Sattigeri, Vijil Chenthamarakshan et al.NeurIPS 2023 · 14 citations
- Noether's Razor: Learning Conserved QuantitiesTycho F. A. van der Ouderaa, Mark van der Wilk, Pim de HaanNeurIPS 2024 · 9 citations
Builds on8
- Approximately Equivariant Networks for Imperfectly Symmetric DynamicsRui Wang, Robin Walters, Rose YuICML 2022 · 111 citations
- Efficient Neural Architecture Search via Proximal IterationsQuanming Yao, Ju Xu, Wei-Wei Tu, Zhanxing ZhuAAAI 2020 · 108 citations
- Meta-learning Symmetries by ReparameterizationAllan Zhou, Tom Knowles, Chelsea FinnICLR 2021 · 105 citations
- Residual Pathway Priors for Soft Equivariance ConstraintsMarc Finzi, Greg Benton, Andrew Gordon WilsonNeurIPS 2021 · 89 citations
- Learning Partial Equivariances From DataDavid W. Romero, Suhas LohitNeurIPS 2022 · 54 citations
Related papers
- A Classification of -invariant Shallow Neural NetworksDevanshu Agrawal, James OstrowskiNeurIPS 2022 · 11 citations
- Recurrent Equivariant Constraint Modulation: Learning Per-Layer Symmetry Relaxation from DataStefanos Pertigkiozoglou, Mircea Petrache, Shubhendu Trivedi, Kostas DaniilidisICML 2026
- Learning Layer-wise Equivariances Automatically using GradientsTycho F. A. van der Ouderaa, Alexander Immer, Mark van der WilkNeurIPS 2023 · 28 citations
- Relaxing Equivariance Constraints with Non-stationary Continuous FiltersTycho F. A. van der Ouderaa, David W. Romero, Mark van der WilkNeurIPS 2022 · 51 citations
- Approximation-Generalization Trade-offs under (Approximate) Group EquivarianceMircea Petrache, Shubhendu TrivediNeurIPS 2023 · 54 citations
