Adapting Text-to-Image Generation with Feature Difference Instruction for Generic Image Restoration
Chao Wang, Hehe Fan, Huichen Yang, Sarvnaz Karimi, Lina Yao, Yi Yang
2025Year
3Top-tier citations
Abstract
Low-light Enhancement Desnowing Deraining Dehazing Denoising Motion Deblurring Mixed Degradations Figure 1. Our image restoration results. The proposed DiffRes introduces cross-modal understanding by leveraging multimodal visionlanguage models through an efficient adapter, without modifying the pre-trained diffusion model. This enables DiffRes to effectively produce clean and sharp results over 10 image restoration tasks. For simplicity, we only show several representative tasks here.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Cited by top-tier papers3
- TPGDiff : Hierarchical Triple-Prior Guided Diffusion for Image RestorationYanjie Tu, Qingsen Yan, Axi Niu, Jiacong TangICML 2026 · 2 citations
- Curriculum Group Policy Optimization: Adaptive Sampling for Unleashing the Potential of Text-to-Image GenerationBaoteng Li, Xianghao Zang, Xinran Wang, Xiangyu Na et al.CVPR 2026
- PointThinker: Point-Incentivized Parallel Thinking for Multimodal Large Language ModelZhengdong Hu, Chao Wang, Fengyun Rao, Jing Lyu et al.CVPR 2026
Builds on48
- Learning Transferable Visual Models From Natural Language SupervisionAlec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh et al.ICML 2021 · 47,906 citations
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser et al.CVPR 2022 · 13,123 citations
- Denoising Diffusion Implicit ModelsJiaming Song, Chenlin Meng, Stefano ErmonICLR 2021 · 11,743 citations
- Photorealistic Text-to-Image Diffusion Models with Deep Language UnderstandingChitwan Saharia, William Chan, Saurabh Saxena, Lala Li et al.NeurIPS 2022 · 8,965 citations
- BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language ModelsJunnan Li, Dongxu Li, Silvio Savarese, Steven C. H. HoiICML 2023 · 7,873 citations
Related papers
- UARE: A Unified Vision-Language Model for Image Quality Assessment, Restoration, and EnhancementWeiqi Li, Xuanyu Zhang, Bin Chen, Jingfen Xie et al.CVPR 2026 · 5 citations
- LD-RPS: Zero-Shot Unified Image Restoration via Latent Diffusion Recurrent Posterior SamplingHuaqiu Li, Yong Wang, Tongwen Huang, Hailang Huang et al.ICCV 2025 · 4 citations
- PromptRestorer: A Prompting Image Restoration Method with Degradation PerceptionCong Wang, Jinshan Pan, Wei Wang, Jiangxin Dong et al.NeurIPS 2023 · 109 citations
- Controlling Vision-Language Models for Multi-Task Image RestorationZiwei Luo, Fredrik K. Gustafsson, Zheng Zhao, Jens Sjölund et al.ICLR 2024 · 111 citations
- DreamClean: Restoring Clean Image Using Deep Diffusion PriorJie Xiao, Ruili Feng, Han Zhang, Zhiheng Liu et al.ICLR 2024 · 23 citations
