Scaling physics-informed hard constraints with mixture-of-experts
Nithin Chalapathi, Yiheng Du, Aditi S. Krishnapriyan
Abstract
Imposing known physical constraints, such as conservation laws, during neural network training introduces an inductive bias that can improve accuracy, reliability, convergence, and data efficiency for modeling physical dynamics. While such constraints can be softly imposed via loss function penalties, recent advancements in differentiable physics and optimization improve performance by incorporating PDE-constrained optimization as individual layers in neural networks. This enables a stricter adherence to physical constraints. However, imposing hard constraints significantly increases computational and memory costs, especially for complex dynamical systems. This is because it requires solving an optimization problem over a large number of points in a mesh, representing spatial and temporal discretizations, which greatly increases the complexity of the constraint. To address this challenge, we develop a scalable approach to enforce hard physical constraints using Mixture-of-Experts (MoE), which can be used with any neural network architecture. Our approach imposes the constraint over smaller decomposed domains, each of which is solved by an "expert" through differentiable optimization. During training, each expert independently performs a localized backpropagation step by leveraging the implicit function theorem; the independence of each expert allows for parallelization across multiple GPUs. Compared to standard differentiable optimization, our scalable approach achieves greater accuracy in the neural PDE solver setting for predicting the dynamics of challenging non-linear systems. We also improve training stability and require significantly less computation time during both training and inference stages.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 02f623e6-4b0a-47b9-b6d5-355308364f19Cited by top-tier papers12
- Generalizing Weather Forecast to Fine-grained Temporal Scales via Physics-AI Hybrid ModelingWanghan Xu, Fenghua Ling, Wenlong Zhang, Tao Han et al.NeurIPS 2024 · 31 citations
- Model Decides How to Tokenize: Adaptive DNA Sequence Tokenization with MxDNALifeng Qiao, Peng Ye, Yuchen Ren, Weiqiang Bai et al.NeurIPS 2024 · 23 citations
- End-to-End Probabilistic Framework for Learning with Hard ConstraintsUtkarsh Utkarsh, Danielle C. Maddix, Ruijun Ma, Michael W. Mahoney et al.ICLR 2026 · 13 citations
- EddyFormer: Accelerated Neural Simulations of Three-Dimensional Turbulence at ScaleYiheng Du, Aditi S. KrishnapriyanNeurIPS 2025 · 8 citations
- TRACE: Learning 3D Gaussian Physical Dynamics from Multi-View VideosJinxi Li, Ziyang Song, Bo YangICCV 2025 · 3 citations
Builds on18
- Language Models are Few-Shot LearnersTom B. Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah et al.NeurIPS 2020 · 64,255 citations
- Characterizing possible failure modes in physics-informed neural networksAditi S. Krishnapriyan, Amir Gholami, Shandian Zhe, Robert M. Kirby et al.NeurIPS 2021 · 1,421 citations
- Scaling Vision with Sparse Mixture of ExpertsCarlos Riquelme, Joan Puigcerver, Basil Mustafa, Maxim Neumann et al.NeurIPS 2021 · 1,213 citations
- Efficient and Modular Implicit DifferentiationMathieu Blondel, Quentin Berthet, Marco Cuturi, Roy Frostig et al.NeurIPS 2022 · 386 citations
- Learning Differential Equations that are Easy to SolveJacob Kelly, Jesse Bettencourt, Matthew J. Johnson, David DuvenaudNeurIPS 2020 · 134 citations
Related papers
- Learning differentiable solvers for systems with hard constraintsGeoffrey Négiar, Michael W. Mahoney, Aditi S. KrishnapriyanICLR 2023 · 6 citations
- NESTOR: A Nested MOE-based Neural Operator for Large-Scale PDE Pre-TrainingDengdi Sun, Xiaoya Zhou, Xiao Wang, Hao Si et al.CVPR 2026 · 2 citations
- Constraint-based graph network simulatorYulia Rubanova, Alvaro Sanchez-Gonzalez, Tobias Pfaff, Peter W. BattagliaICML 2022 · 34 citations
- DisjunctiveNet: Neural Symbolic Learning via Differentiable Convexified Optimization LayersShraman Pal, Can LiICML 2026
- Deep Conservation: A Latent-Dynamics Model for Exact Satisfaction of Physical Conservation LawsKookjin Lee, Kevin T. CarlbergAAAI 2021 · 67 citations
