Dissecting Non-Vacuous Generalization Bounds based on the Mean-Field Approximation
Konstantinos Pitas
摘要
Explaining how overparametrized neural networks simultaneously achieve low risk and zero empirical risk on benchmark datasets is an open problem. PAC-Bayes bounds optimized using variational inference (VI) have been recently proposed as a promising direction in obtaining non-vacuous bounds. We show empirically that this approach gives negligible gains when modeling the posterior as a Gaussian with diagonal covariance--known as the mean-field approximation. We investigate common explanations, such as the failure of VI due to problems in optimization or choosing a suboptimal prior. Our results suggest that investigating richer posteriors is the most promising direction forward.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper2
- On the generalization of learning algorithms that do not convergeNisha Chandramoorthy, Andreas Loukas, Khashayar Gatmiry, Stefanie JegelkaNeurIPS 2022 · 被引用 13 次
- Optimization and Bayes: A Trade-off for Overparameterized Neural NetworksZhengmian Hu, Heng HuangNeurIPS 2023 · 被引用 1 次
它引用的顶会 Paper4
- Normalized Flat Minima: Exploring Scale Invariant Definition of Flat Minima for Neural Networks Using PAC-Bayesian AnalysisYusuke Tsuzuku, Issei Sato, Masashi SugiyamaICML 2020 · 被引用 91 次
- In Defense of Uniform Convergence: Generalization via Derandomization with an Application to Interpolating PredictorsJeffrey Negrea, Gintare Karolina Dziugaite, Daniel M. RoyICML 2020 · 被引用 66 次
- Compression based bound for non-compressed network: unified generalization error analysis of large compressible deep neural networkTaiji Suzuki, Hiroshi Abe, Tomoaki NishimuraICLR 2020 · 被引用 57 次
- Information-Theoretic Local Minima Characterization and RegularizationZhiwei Jia, Hao SuICML 2020 · 被引用 22 次
相关 Paper
- Efficient Low Rank Gaussian Variational Inference for Neural NetworksMarcin Tomczak, Siddharth Swaroop, Richard E. TurnerNeurIPS 2020 · 被引用 37 次
- On the detrimental effect of invariances in the likelihood for variational inferenceRichard Kurle, Ralf Herbrich, Tim Januschowski, Yuyang Wang 等NeurIPS 2022 · 被引用 10 次
- VIKING: Deep variational inference with stochastic projectionsSamuel Matthiesen, Hrittik Roy, Nicholas Krämer, Yevgen Zainchkovskyy 等NeurIPS 2025 · 被引用 3 次
- The k-tied Normal Distribution: A Compact Parameterization of Gaussian Mean Field Posteriors in Bayesian Neural NetworksJakub Swiatkowski, Kevin Roth, Bastiaan S. Veeling, Linh Tran 等ICML 2020 · 被引用 52 次
- Collapsed Variational Bounds for Bayesian Neural NetworksMarcin Tomczak, Siddharth Swaroop, Andrew Y. K. Foong, Richard E. TurnerNeurIPS 2021 · 被引用 14 次
