Sinusoidal Initialization, Time for a New Start
Alberto Fernández-Hernández, José I. Mestre, Manuel F. Dolz, José Duato, Enrique S. Quintana-Ortí
摘要
Initialization plays a critical role in Deep Neural Network training, directly influencing convergence, stability, and generalization. Common approaches such as Glorot and He initializations rely on randomness, which can produce uneven weight distributions across layer connections. In this paper, we introduce the Sinusoidal initialization, a novel deterministic method that employs sinusoidal functions to construct structured weight matrices expressly to improve the spread and balance of weights throughout the network while simultaneously fostering a more uniform, well-conditioned distribution of neuron activation states from the very first forward pass. Because Sinusoidal initialization begins with weights and activations that are already evenly and efficiently utilized, it delivers consistently faster convergence, greater training stability, and higher final accuracy across a wide range of models, including convolutional neural networks, vision transformers, and large language models. On average, our experiments show an increase of 4.9% in final validation accuracy and 20.9% in convergence speed. By replacing randomness with structure, this initialization provides a stronger and more reliable foundation for Deep Learning systems.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
它引用的顶会 Paper2
- An Image is Worth 16x16 Words: Transformers for Image Recognition at ScaleAlexey Dosovitskiy, Lucas Beyer, Alexander Kolesnikov, Dirk Weissenborn 等ICLR 2021 · 被引用 21,477 次
- Beyond Signal Propagation: Is Feature Diversity Necessary in Deep Neural Network Initialization?Yaniv Blumenfeld, Dar Gilboa, Daniel SoudryICML 2020 · 被引用 18 次
相关 Paper
- Fast Training of Sinusoidal Neural Fields via Scaling InitializationTaesun Yeom, Sangyoon Lee, Jaeho LeeICLR 2025
- A New Initialization to Control Gradients in Sinusoidal Neural NetworksAndrea Combette, Nelly Pustelnik, Antoine VenailleICLR 2026
- Conditioned Initialization for AttentionHemanth Saratchandran, Simon LuceyICLR 2026
- Tuning the Frequencies: Robust Training for Sinusoidal Neural NetworksTiago Novello, Diana Aldana, Andre Araujo, Luiz VelhoCVPR 2025
- AutoInit: Analytic Signal-Preserving Weight Initialization for Neural NetworksGarrett Bingham, Risto MiikkulainenAAAI 2023 · 被引用 6 次
