Deep Audio Priors Emerge From Harmonic Convolutional Networks
Zhoutong Zhang, Yunyun Wang, Chuang Gan, Jiajun Wu, Joshua B. Tenenbaum, Antonio Torralba, William T. Freeman
摘要
Convolutional neural networks (CNNs) excel in image recognition and generation. Among many efforts to explain their effectiveness, experiments show that CNNs carry strong inductive biases that capture natural image priors. Do deep networks also have inductive biases for audio signals? In this paper, we empirically show that current network architectures for audio processing do not show strong evidence in capturing such priors. We propose Harmonic Convolution, an operation that helps deep networks distill priors in audio signals by explicitly utilizing the harmonic structure within. This is done by engineering the kernel to be supported by sets of harmonic series, instead of local neighborhoods for convolutional kernels. We show that networks using Harmonic Convolution can reliably model audio priors and achieve high performance in unsupervised audio restoration tasks. With Harmonic Convolution, they also achieve better generalization performance for sound source separation.
问问这篇 Paper
问问你的智能体。
Lune 读过与它相关的顶会 Paper,每个回答都会注明依据哪几篇。
引用它的顶会 Paper3
- Listening to Sounds of Silence for Speech DenoisingRuilin Xu, Rundi Wu, Yuko Ishiwaka, Carl Vondrick 等NeurIPS 2020 · 被引用 40 次
- Catch-A-Waveform: Learning to Generate Audio from a Single Short ExampleGal Greshler, Tamar Rott Shaham, Tomer MichaeliNeurIPS 2021 · 被引用 29 次
- Deep Harmonic Finesse: Signal Separation in Wearable Systems with Limited DataMahya Saffarpour, Weitai Qian, Kourosh Vali, Begum Kasap 等DAC 2024 · 被引用 4 次
相关 Paper
- UniRepLKNet: A Universal Perception Large-Kernel ConvNet for Audio, Video, Point Cloud, Time-Series and Image RecognitionXiaohan Ding, Yiyuan Zhang, Yixiao Ge, Sijie Zhao 等CVPR 2024
- SinBasis Networks: Matrix-Equivalent Feature Extraction for Wave-Like Optical SpectrogramsYuzhou Zhu, Zheng Zhang, Ruyi Zhang, Liang ZhouAAAI 2026 · 被引用 1 次
- LEAF: A Learnable Frontend for Audio ClassificationNeil Zeghidour, Olivier Teboul, Félix de Chaumont Quitry, Marco TagliasacchiICLR 2021 · 被引用 181 次
- Approximation and Learning with Deep Convolutional Models: a Kernel PerspectiveAlberto BiettiICLR 2022 · 被引用 33 次
- ISNAS-DIP: Image-Specific Neural Architecture Search for Deep Image PriorMetin Ersin Arican, Ozgur Kara, Gustav Bredell, Ender KonukogluCVPR 2022 · 被引用 19 次
