Efficient Continual Finite-Sum Minimization
Ioannis Mavrothalassitis, Stratis Skoulakis, Leello Tadesse Dadi, Volkan Cevher
摘要
Given a sequence of functions with , finite-sum minimization seeks a point minimizing . In this work, we propose a key twist into the finite-sum minimization, dubbed as continual finite-sum minimization, that asks for a sequence of points such that each minimizes the prefix-sum . Assuming that each prefix-sum is strongly convex, we develop a first-order continual stochastic variance reduction gradient method () producing an -optimal sequence with overall first-order oracles (FO). An FO corresponds to the computation of a single gradient at a given for some . Our approach significantly improves upon the FOs that requires and the FOs that state-of-the-art variance reduction methods such as require. We also prove that there is no natural first-order method with gradient complexity for , establishing that the first-order complexity of our method is nearly tight.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper7
- PAGE: A Simple and Optimal Probabilistic Gradient Estimator for Nonconvex OptimizationZhize Li, Hongyan Bao, Xiangliang Zhang, Peter RichtárikICML 2021 · 被引用 164 次
- Constrained Few-shot Class-incremental LearningMichael Hersche, Geethan Karunaratne, Giovanni Cherubini, Luca Benini 等CVPR 2022 · 被引用 152 次
- Least Squares Regression with Markovian Data: Fundamental Limits and AlgorithmsDheeraj Nagaraj, Xian Wu, Guy Bresler, Prateek Jain 等NeurIPS 2020 · 被引用 73 次
- Near-optimal Offline and Streaming Algorithms for Learning Non-Linear Dynamical SystemsSuhas S. Kowshik, Dheeraj Nagaraj, Prateek Jain, Praneeth NetrapalliNeurIPS 2021 · 被引用 28 次
- Variance Reduction via Accelerated Dual Averaging for Finite-Sum OptimizationChaobing Song, Yong Jiang, Yi MaNeurIPS 2020 · 被引用 25 次
相关 Paper
- Stochastic Distributed Optimization under Average Second-order Similarity: Algorithms and AnalysisDachao Lin, Yuze Han, Haishan Ye, Zhihua ZhangNeurIPS 2023 · 被引用 17 次
- An Effective Dynamic Gradient Calibration Method for Continual LearningWeichen Lin, Jiaxiang Chen, Ruomin Huang, Hu DingICML 2024 · 被引用 2 次
- Kill a Bird with Two Stones: Closing the Convergence Gaps in Non-Strongly Convex Optimization by Directly Accelerated SVRG with Double Compensation and SnapshotsYuanyuan Liu, Fanhua Shang, Weixin An, Hongying Liu 等ICML 2022 · 被引用 2 次
- Double Variance Reduction: A Smoothing Trick for Composite Optimization Problems without First-Order GradientHao Di, Haishan Ye, Yueling Zhang, Xiangyu Chang 等ICML 2024 · 被引用 2 次
- Adaptive Stochastic Variance Reduction for Non-convex Finite-Sum MinimizationAli Kavis, Stratis Skoulakis, Kimon Antonakopoulos, Leello Tadesse Dadi 等NeurIPS 2022 · 被引用 21 次
