GradAug: A New Regularization Method for Deep Neural Networks
Taojiannan Yang, Sijie Zhu, Chen Chen
Abstract
We propose a new regularization method to alleviate over-fitting in deep neural networks. The key idea is utilizing randomly transformed training samples to regularize a set of sub-networks, which are originated by sampling the width of the original network, in the training process. As such, the proposed method introduces self-guided disturbances to the raw gradients of the network and therefore is termed as Gradient Augmentation (GradAug). We demonstrate that GradAug can help the network learn well-generalized and more diverse representations. Moreover, it is easy to implement and can be applied to various structures and applications. GradAug improves ResNet-50 to 78.79% on ImageNet classification, which is a new state-of-the-art accuracy. By combining with CutMix, it further boosts the performance to 79.67%, which outperforms an ensemble of advanced training tricks. The generalization ability is evaluated on COCO object detection and instance segmentation where GradAug significantly surpasses other state-of-the-art methods. GradAug is also robust to image distortions and FGSM adversarial attacks and is highly effective in low data regimes. Code is available at https: //github.com/taoyang1122/GradAug
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 9a497bf7-57f2-457c-af36-4652e384b204Cited by top-tier papers9
- Local Learning Matters: Rethinking Data Heterogeneity in Federated LearningMatías Mendieta, Taojiannan Yang, Pu Wang, Minwoo Lee et al.CVPR 2022 · 176 citations
- MixMo: Mixing Multiple Inputs for Multiple Outputs via Deep SubnetworksAlexandre Ramé, Rémy Sun, Matthieu CordICCV 2021 · 64 citations
- RoPGen: Towards Robust Code Authorship Attribution via Automatic Coding Style TransformationZhen Li, Qian (Guenevere) Chen, Chen Chen, Yayi Zou et al.ICSE 2022 · 39 citations
- Network Augmentation for Tiny Deep LearningHan Cai, Chuang Gan, Ji Lin, Song HanICLR 2022 · 34 citations
- FedUV: Uniformity and Variance for Heterogeneous Federated LearningHa Min Son, Moon-Hyun Kim, Tai-Myoung Chung, Chao Huang et al.CVPR 2024 · 11 citations
Builds on5
- CutMix: Regularization Strategy to Train Strong Classifiers With Localizable FeaturesSangdoo Yun, Dongyoon Han, Sanghyuk Chun, Seong Joon Oh et al.ICCV 2019 · 5,843 citations
- Universally Slimmable Networks and Improved Training TechniquesJiahui Yu, Thomas S. HuangICCV 2019 · 444 citations
- Revisiting Knowledge Distillation via Label Smoothing RegularizationLi Yuan, Francis E. H. Tay, Guilin Li, Tao Wang et al.CVPR 2020
- Cogradient Descent for Bilinear OptimizationLi'an Zhuo, Baochang Zhang, Linlin Yang, Hanlin Chen et al.CVPR 2020
- Multi-Scale Progressive Fusion Network for Single Image DerainingKui Jiang, Zhongyuan Wang, Peng Yi, Chen Chen et al.CVPR 2020
Related papers
- Network as Regularization for Training Deep Neural Networks: Framework, Model and PerformanceKai Tian, Yi Xu, Jihong Guan, Shuigeng ZhouAAAI 2020 · 6 citations
- Cut-Thumbnail: A Novel Data Augmentation for Convolutional Neural NetworkTianshu Xie, Xuan Cheng, Xiaomin Wang, Minghui Liu et al.ACM MM 2021 · 36 citations
- SaliencyMix: A Saliency Guided Data Augmentation Strategy for Better RegularizationA. F. M. Shahab Uddin, Mst. Sirazam Monira, Wheemyung Shin, TaeChoong Chung et al.ICLR 2021 · 271 citations
- PatchUp: A Feature-Space Block-Level Regularization Technique for Convolutional Neural NetworksMojtaba Faramarzi, Mohammad Amini, Akilesh Badrinaaraayanan, Vikas Verma et al.AAAI 2022 · 40 citations
- Consistency Regularization for Adversarial RobustnessJihoon Tack, Sihyun Yu, Jongheon Jeong, Minseon Kim et al.AAAI 2022 · 75 citations
