Feature Quantization Improves GAN Training
Yang Zhao, Chunyuan Li, Ping Yu, Jianfeng Gao, Changyou Chen
摘要
The instability in GAN training has been a long-standing problem despite remarkable research efforts. We identify that instability issues stem from difficulties of performing feature matching with mini-batch statistics, due to a fragile balance between the fixed target distribution and the progressively generated distribution. In this work, we propose Feature Quantization (FQ) for the discriminator, to embed both true and fake data samples into a shared discrete space. The quantized values of FQ are constructed as an evolving dictionary, which is consistent with feature statistics of the recent distribution history. Hence, FQ implicitly enables robust feature matching in a compact space. Our method can be easily plugged into existing GAN models, with little computational overhead in training. We apply FQ to 3 representative GAN models on 9 benchmarks: BigGAN for image generation, StyleGAN for face synthesis, and U-GAT-IT for unsupervised image-to-image translation. Extensive experimental results show that the proposed FQ-GAN can improve the FID scores of baseline methods by a large margin on a variety of tasks, achieving new state-of-the-art performance.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper18
- Training Generative Adversarial Networks with Limited DataTero Karras, Miika Aittala, Janne Hellsten, Samuli Laine 等NeurIPS 2020 · 被引用 2,345 次
- Diff-Instruct: A Universal Approach for Transferring Knowledge From Pre-trained Diffusion ModelsWeijian Luo, Tianyang Hu, Shifeng Zhang, Jiacheng Sun 等NeurIPS 2023 · 被引用 268 次
- One-Step Diffusion Distillation through Score Implicit MatchingWeijian Luo, Zemin Huang, Zhengyang Geng, J. Zico Kolter 等NeurIPS 2024 · 被引用 81 次
- Training GANs with Stronger Augmentations via Contrastive DiscriminatorJongheon Jeong, Jinwoo ShinICLR 2021 · 被引用 68 次
- Learning Energy-Based Generative Models via Coarse-to-Fine Expanding and SamplingYang Zhao, Jianwen Xie, Ping LiICLR 2021 · 被引用 51 次
它引用的顶会 Paper4
- U-GAT-IT: Unsupervised Generative Attentional Networks with Adaptive Layer-Instance Normalization for Image-to-Image TranslationJunho Kim, Minjae Kim, Hyeonwoo Kang, Kwanghee LeeICLR 2020 · 被引用 632 次
- Consistency Regularization for Generative Adversarial NetworksHan Zhang, Zizhao Zhang, Augustus Odena, Honglak LeeICLR 2020 · 被引用 305 次
- GAN Memory with No ForgettingYulai Cong, Miaoyun Zhao, Jianqiao Li, Sijia Wang 等NeurIPS 2020 · 被引用 156 次
- Analyzing and Improving the Image Quality of StyleGANTero Karras, Samuli Laine, Miika Aittala, Janne Hellsten 等CVPR 2020
相关 Paper
- Style Quantization for Data-Efficient GAN TrainingJian Wang, Xin Lan, Jizhe Zhou, Yuxin Tian 等CVPR 2025
- Unsupervised Image-to-Image Translation with Generative PriorShuai Yang, Liming Jiang, Ziwei Liu, Chen Change LoyCVPR 2022 · 被引用 51 次
- Reusing Discriminators for Encoding: Towards Unsupervised Image-to-Image TranslationRunfa Chen, Wenbing Huang, Binghui Huang, Fuchun Sun 等CVPR 2020
- SPatchGAN: A Statistical Feature Based Discriminator for Unsupervised Image-to-Image TranslationXuning Shao, Weidong ZhangICCV 2021 · 被引用 34 次
- A U-Net Based Discriminator for Generative Adversarial NetworksEdgar Schönfeld, Bernt Schiele, Anna KhorevaCVPR 2020
