Distributed Extra-gradient with Optimal Complexity and Communication Guarantees
Ali Ramezani-Kebrya, Kimon Antonakopoulos, Igor Krawczuk, Justin Deschenaux, Volkan Cevher
Abstract
We consider monotone variational inequality (VI) problems in multi-GPU settings where multiple processors/workers/clients have access to local stochastic dual vectors. This setting includes a broad range of important problems from distributed convex minimization to min-max and games. Extra-gradient, which is a de facto algorithm for monotone VI problems, has not been designed to be communication-efficient. To this end, we propose a quantized generalized extra-gradient (Q-GenX), which is an unbiased and adaptive compression method tailored to solve VIs. We provide an adaptive step-size rule, which adapts to the respective noise profiles at hand and achieve a fast rate of under relative noise, and an order-optimal under absolute noise and show distributed training accelerates convergence. Finally, we validate our theoretical results by providing real-world experiments and training generative adversarial networks on multiple GPUs.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 5f24c5f7-22c4-4fd5-85a0-2f71aa99526bCited by top-tier papers3
- Local Composite Saddle Point OptimizationSite Bai, Brian BullinsICLR 2024 · 1 citation
- Addressing Label Shift in Distributed Learning via Entropy RegularizationZhiyuan Wu, Changkyu Choi, Xiangcheng Cao, Volkan Cevher et al.ICLR 2025
- Layer-wise Quantization for Quantized Optimistic Dual AveragingAnh Duc Nguyen, Ilia Markov, Frank Zhengqing Wu, Ali Ramezani-Kebrya et al.ICML 2025
Builds on7
- Adaptive Gradient Quantization for Data-Parallel SGDFartash Faghri, Iman Tabrizian, Ilia Markov, Dan Alistarh et al.NeurIPS 2020 · 108 citations
- Stochastic Gradient Descent-Ascent and Consensus Optimization for Smooth Games: Convergence Analysis under Expected Co-coercivityNicolas Loizou, Hugo Berard, Gauthier Gidel, Ioannis Mitliagkas et al.NeurIPS 2021 · 68 citations
- Optimal Algorithms for Decentralized Stochastic Variational InequalitiesDmitry Kovalev, Aleksandr Beznosikov, Abdurakhmon Sadiev, Michael Persiianov et al.NeurIPS 2022 · 41 citations
- Sifting through the noise: Universal first-order methods for stochastic variational inequalitiesKimon Antonakopoulos, Thomas Pethick, Ali Kavis, Panayotis Mertikopoulos et al.NeurIPS 2021 · 18 citations
- A Flexible Framework for Communication-Efficient Machine LearningSarit Khirirat, Sindri Magnússon, Arda Aytekin, Mikael JohanssonAAAI 2021 · 16 citations
Related papers
- Decentralized Local Stochastic Extra-Gradient for Variational InequalitiesAleksandr Beznosikov, Pavel E. Dvurechensky, Anastasia Koloskova, Valentin Samokhin et al.NeurIPS 2022 · 49 citations
- Distributed Methods with Compressed Communication for Solving Variational Inequalities, with Theoretical GuaranteesAleksandr Beznosikov, Peter Richtárik, Michael Diskin, Max Ryabinin et al.NeurIPS 2022 · 25 citations
- Optimistic Dual Extrapolation for Coherent Non-monotone Variational InequalitiesChaobing Song, Zhengyuan Zhou, Yichao Zhou, Yong Jiang et al.NeurIPS 2020 · 55 citations
- Communication-Efficient Gradient Descent-Accent Methods for Distributed Variational Inequalities: Unified Analysis and Local UpdatesSiqi Zhang, Sayantan Choudhury, Sebastian U. Stich, Nicolas LoizouICLR 2024 · 9 citations
- ErrorCompensatedX: error compensation for variance reduced algorithmsHanlin Tang, Yao Li, Ji Liu, Ming YanNeurIPS 2021 · 13 citations
