HAODiff: Human-Aware One-Step Diffusion via Dual-Prompt Guidance
Jue Gong, Tingyu Yang, Jingkai Wang, Zheng Chen, Xin Liu, Hong Gu, Yulun Zhang, Xiaokang Yang
Abstract
Human-centered images often suffer from severe generic degradation during transmission and are prone to human motion blur (HMB), making restoration challenging. Existing research lacks sufficient focus on these issues, as both problems often coexist in practice. To address this, we design a degradation pipeline that simulates the coexistence of HMB and generic noise, generating synthetic degraded data to train our proposed HAODiff, a human-aware one-step diffusion. Specifically, we propose a triple-branch dual-prompt guidance (DPG), which leverages high-quality images, residual noise (LQ minus HQ), and HMB segmentation masks as training targets. It produces a positive-negative prompt pair for classifier-free guidance (CFG) in a single diffusion step. The resulting adaptive dual prompts let HAODiff exploit CFG more effectively, boosting robustness against diverse degradations. For fair evaluation, we introduce MPII-Test, a benchmark rich in combined noise and HMB cases. Extensive experiments show that our HAODiff surpasses existing state-of-the-art (SOTA) methods in terms of both quantitative metrics and visual quality on synthetic and real-world datasets, including our introduced MPII-Test. Code is available at: https://github.com/gobunu/HAODiff.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Cited by top-tier papers4
- Improved Adversarial Diffusion Compression for Real-World Video Super-ResolutionBin Chen, Weiqi Li, Shijie Zhao, Xuanyu Zhang et al.ICLR 2026 · 5 citations
- Face2Scene: Using Facial Degradation as an Oracle for Diffusion-Based Scene RestorationAmirhossein Kazerouni, Maitreya Suin, Tristan T Aumentado-Armstrong, Sina Honari et al.CVPR 2026
- SODiff:Semantic-Oriented Diffusion Model for JPEG Compression Artifacts RemovalTingyu Yang, Jue Gong, Jinpei Guo, Wenbo Li et al.AAAI 2026
- Light Up Your Face: A Physically Consistent Dataset and Diffusion Model for Face Fill-Light EnhancementJue Gong, Zihan Zhou, Jingkai Wang, Xiaohong Liu et al.ICML 2026
Builds on25
- Swin Transformer: Hierarchical Vision Transformer using Shifted WindowsZe Liu, Yutong Lin, Yue Cao, Han Hu et al.ICCV 2021 · 31,683 citations
- An Image is Worth 16x16 Words: Transformers for Image Recognition at ScaleAlexey Dosovitskiy, Lucas Beyer, Alexander Kolesnikov, Dirk Weissenborn et al.ICLR 2021 · 21,477 citations
- LoRA: Low-Rank Adaptation of Large Language ModelsEdward J. Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu et al.ICLR 2022 · 18,833 citations
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser et al.CVPR 2022 · 13,123 citations
- Denoising Diffusion Implicit ModelsJiaming Song, Chenlin Meng, Stefano ErmonICLR 2021 · 11,743 citations
Related papers
- TPGDiff : Hierarchical Triple-Prior Guided Diffusion for Image RestorationYanjie Tu, Qingsen Yan, Axi Niu, Jiacong TangICML 2026 · 2 citations
- Visual-Instructed Degradation Diffusion for All-in-One Image RestorationWenyang Luo, Haina Qin, Zewen Chen, Libin Wang et al.CVPR 2025
- PGDiff: Guiding Diffusion Models for Versatile Face Restoration via Partial GuidancePeiqing Yang, Shangchen Zhou, Qingyi Tao, Chen Change LoyNeurIPS 2023 · 82 citations
- Human Body Restoration with One-Step Diffusion Model and A New BenchmarkJue Gong, Jingkai Wang, Zheng Chen, Xin Liu et al.ICML 2025
- UP-Restorer: When Unrolling Meets Prompts for Unified Image RestorationMinghao Liu, Wenhan Yang, Jinyi Luo, Jiaying LiuAAAI 2025 · 7 citations
