HAODiff: Human-Aware One-Step Diffusion via Dual-Prompt Guidance
Jue Gong, Tingyu Yang, Jingkai Wang, Zheng Chen, Xin Liu, Hong Gu, Yulun Zhang, Xiaokang Yang
摘要
Human-centered images often suffer from severe generic degradation during transmission and are prone to human motion blur (HMB), making restoration challenging. Existing research lacks sufficient focus on these issues, as both problems often coexist in practice. To address this, we design a degradation pipeline that simulates the coexistence of HMB and generic noise, generating synthetic degraded data to train our proposed HAODiff, a human-aware one-step diffusion. Specifically, we propose a triple-branch dual-prompt guidance (DPG), which leverages high-quality images, residual noise (LQ minus HQ), and HMB segmentation masks as training targets. It produces a positive-negative prompt pair for classifier-free guidance (CFG) in a single diffusion step. The resulting adaptive dual prompts let HAODiff exploit CFG more effectively, boosting robustness against diverse degradations. For fair evaluation, we introduce MPII-Test, a benchmark rich in combined noise and HMB cases. Extensive experiments show that our HAODiff surpasses existing state-of-the-art (SOTA) methods in terms of both quantitative metrics and visual quality on synthetic and real-world datasets, including our introduced MPII-Test. Code is available at: https://github.com/gobunu/HAODiff.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper4
- Improved Adversarial Diffusion Compression for Real-World Video Super-ResolutionBin Chen, Weiqi Li, Shijie Zhao, Xuanyu Zhang 等ICLR 2026 · 被引用 5 次
- Face2Scene: Using Facial Degradation as an Oracle for Diffusion-Based Scene RestorationAmirhossein Kazerouni, Maitreya Suin, Tristan T Aumentado-Armstrong, Sina Honari 等CVPR 2026
- SODiff:Semantic-Oriented Diffusion Model for JPEG Compression Artifacts RemovalTingyu Yang, Jue Gong, Jinpei Guo, Wenbo Li 等AAAI 2026
- Light Up Your Face: A Physically Consistent Dataset and Diffusion Model for Face Fill-Light EnhancementJue Gong, Zihan Zhou, Jingkai Wang, Xiaohong Liu 等ICML 2026
它引用的顶会 Paper25
- Swin Transformer: Hierarchical Vision Transformer using Shifted WindowsZe Liu, Yutong Lin, Yue Cao, Han Hu 等ICCV 2021 · 被引用 31,683 次
- An Image is Worth 16x16 Words: Transformers for Image Recognition at ScaleAlexey Dosovitskiy, Lucas Beyer, Alexander Kolesnikov, Dirk Weissenborn 等ICLR 2021 · 被引用 21,477 次
- LoRA: Low-Rank Adaptation of Large Language ModelsEdward J. Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu 等ICLR 2022 · 被引用 18,833 次
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser 等CVPR 2022 · 被引用 13,123 次
- Denoising Diffusion Implicit ModelsJiaming Song, Chenlin Meng, Stefano ErmonICLR 2021 · 被引用 11,743 次
相关 Paper
- TPGDiff : Hierarchical Triple-Prior Guided Diffusion for Image RestorationYanjie Tu, Qingsen Yan, Axi Niu, Jiacong TangICML 2026 · 被引用 2 次
- Visual-Instructed Degradation Diffusion for All-in-One Image RestorationWenyang Luo, Haina Qin, Zewen Chen, Libin Wang 等CVPR 2025
- PGDiff: Guiding Diffusion Models for Versatile Face Restoration via Partial GuidancePeiqing Yang, Shangchen Zhou, Qingyi Tao, Chen Change LoyNeurIPS 2023 · 被引用 82 次
- Human Body Restoration with One-Step Diffusion Model and A New BenchmarkJue Gong, Jingkai Wang, Zheng Chen, Xin Liu 等ICML 2025
- UP-Restorer: When Unrolling Meets Prompts for Unified Image RestorationMinghao Liu, Wenhan Yang, Jinyi Luo, Jiaying LiuAAAI 2025 · 被引用 7 次
