One More Step: A Versatile Plug-and-Play Module for Rectifying Diffusion Schedule Flaws and Enhancing Low-Frequency Controls
Minghui Hu, Jianbin Zheng, Chuanxia Zheng, Chaoyue Wang, Dacheng Tao, Tat-Jen Cham
2024年份
6顶会引用
摘要
Close-up portrait of a man wearing suit posing in a dark studio, rim lighting, teal hue, octane, unreal A bald eagle against a white background A dark town square lit only by a few torchlights Solid black background Majestic white angel sculpture inside a solemn cathedral, exquisite details and a sacred ambiance, bright and pure visual effects, extreme white background Prompt (a) (b)
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper6
- Phased Consistency ModelsFu-Yun Wang, Zhaoyang Huang, Alexander William Bergman, Dazhong Shen 等NeurIPS 2024 · 被引用 86 次
- Golden Noise for Diffusion Models: A Learning FrameworkZikai Zhou, Shitong Shao, Lichen Bai, Shufei Zhang 等ICCV 2025 · 被引用 9 次
- Redefining in Dictionary: Towards an Enhanced Semantic Understanding of Creative GenerationFu Feng, Yucheng Xie, Xu Yang, Jing Wang 等CVPR 2025
- Boost-and-Skip: A Simple Guidance-Free Diffusion for Minority GenerationSoobin Um, Beomsu Kim, Jong Chul YeICML 2025
- Rectifying the Emotional Flow: Aligning Priors and Dynamic Guidance for High-Arousal Text-to-SpeechFangming Feng, Dongjie Fu, Zequn Xie, Yu Zhang 等ACL 2026
它引用的顶会 Paper14
- Learning Transferable Visual Models From Natural Language SupervisionAlec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh 等ICML 2021 · 被引用 47,906 次
- Denoising Diffusion Probabilistic ModelsJonathan Ho, Ajay Jain, Pieter AbbeelNeurIPS 2020 · 被引用 35,902 次
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser 等CVPR 2022 · 被引用 13,123 次
- Denoising Diffusion Implicit ModelsJiaming Song, Chenlin Meng, Stefano ErmonICLR 2021 · 被引用 11,743 次
- Adding Conditional Control to Text-to-Image Diffusion ModelsLvmin Zhang, Anyi Rao, Maneesh AgrawalaICCV 2023 · 被引用 6,759 次
相关 Paper
- LucidDreamer: Towards High-Fidelity Text-to-3D Generation via Interval Score MatchingYixun Liang, Xin Yang, Jiantao Lin, Haodong Li 等CVPR 2024
- Mimir: Improving Video Diffusion Models for Precise Text UnderstandingShuai Tan, Biao Gong, Yutong Feng, Kecheng Zheng 等CVPR 2025
- Text-to-3D Generation with Bidirectional Diffusion Using Both 2D and 3D PriorsLihe Ding, Shaocong Dong, Zhanpeng Huang, Zibin Wang 等CVPR 2024
- PrimeComposer: Faster Progressively Combined Diffusion for Image Composition with Attention SteeringYibin Wang, Weizhong Zhang, Jianwei Zheng, Cheng JinACM MM 2024 · 被引用 9 次
- Total relighting: learning to relight portraits for background replacementRohit Pandey, Sergio Orts-Escolano, Chloe LeGendre, Christian Häne 等SIGGRAPH 2021 · 被引用 138 次
