Transition Constrained Bayesian Optimization via Markov Decision Processes
Jose Pablo Folch, Calvin Tsay, Robert M. Lee, Behrang Shafei, Weronika Ormaniec, Andreas Krause, Mark van der Wilk, Ruth Misener, Mojmir Mutny
Abstract
Bayesian optimization is a methodology to optimize black-box functions. Traditionally, it focuses on the setting where you can arbitrarily query the search space. However, many real-life problems do not offer this flexibility; in particular, the search space of the next query may depend on previous ones. Example challenges arise in the physical sciences in the form of local movement constraints, required monotonicity in certain variables, and transitions influencing the accuracy of measurements. Altogether, such transition constraints necessitate a form of planning. This work extends classical Bayesian optimization via the framework of Markov Decision Processes. We iteratively solve a tractable linearization of our utility function using reinforcement learning to obtain a policy that plans ahead for the entire horizon. This is a parallel to the optimization of an acquisition function in policy space. The resulting policy is potentially history-dependent and non-Markovian. We showcase applications in chemical reactor optimization, informative path planning, machine calibration, and other synthetic examples.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext dd4b5165-a392-419a-9e3d-39fad4f54905Cited by top-tier papers2
- Optimizing the Unknown: Black Box Bayesian Optimization with Energy-Based Model and Reinforcement LearningRuiyao Miao, Junren Xiao, Shiya Tsang, Hui Xiong et al.NeurIPS 2025 · 2 citations
- BALLAST: Bayesian Active Learning with Look-ahead Amendment for Sea-drifter Trajectories under Spatio-Temporal Vector FieldsRui-Yang Zhang, Lachlan Astfalck, Edward Cripps, David Leslie et al.ICML 2026 · 1 citation
Builds on13
- Reward is enough for convex MDPsTom Zahavy, Brendan O'Donoghue, Guillaume Desjardins, Satinder SinghNeurIPS 2021 · 96 citations
- Joint Entropy Search for Multi-Objective Bayesian OptimizationBen Tu, Axel Gandy, Nikolas Kantas, Behrang ShafeiNeurIPS 2022 · 75 citations
- Joint Entropy Search For Maximally-Informed Bayesian OptimizationCarl Hvarfner, Frank Hutter, Luigi NardiNeurIPS 2022 · 69 citations
- BINOCULARS for efficient, nonmyopic sequential experimental designShali Jiang, Henry Chai, Javier González, Roman GarnettICML 2020 · 56 citations
- Efficient Nonmyopic Bayesian Optimization via One-Shot Multi-Step TreesShali Jiang, Daniel R. Jiang, Maximilian Balandat, Brian Karrer et al.NeurIPS 2020 · 54 citations
Related papers
- Local policy search with Bayesian optimizationSarah Müller, Alexander von Rohr, Sebastian TrimpeNeurIPS 2021 · 67 citations
- Local Bayesian optimization via maximizing probability of descentQuan Nguyen, Kaiwen Wu, Jacob R. Gardner, Roman GarnettNeurIPS 2022 · 41 citations
- Bayesian Optimized Monte Carlo PlanningJohn Mern, Anil Yildiz, Zachary Sunberg, Tapan Mukerji et al.AAAI 2021 · 33 citations
- Re-Examining Linear Embeddings for High-Dimensional Bayesian OptimizationBenjamin Letham, Roberto Calandra, Akshara Rai, Eytan BakshyNeurIPS 2020 · 152 citations
- Constrained Causal Bayesian OptimizationVirginia Aglietti, Alan Malek, Ira Ktena, Silvia ChiappaICML 2023 · 9 citations
