DreamText: High Fidelity Scene Text Synthesis
Yibin Wang, Weizhong Zhang, Honghui Xu, Cheng Jin
2025Year
8Top-tier citations
Abstract
Ours Ours input+mask "WAKANDA" "FOREVER" "ZOOTOPIA" Ours input+mask "STUDENT" "now" Ours input+mask "ADVENTURE" input+mask input+mask Ours Ours Text Editing Text Synthesis Figure 1. Displayed are the results generated using our DREAMTEXT, showcasing its prowess across varied inputs.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 9800093d-a586-4d9e-b282-a52f67a3d5b7Cited by top-tier papers8
- TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text RenderingHanshen Zhu, Yuliang Liu, Xuecheng Wu, An-Lan Wang et al.CVPR 2026 · 15 citations
- TextSSR: Diffusion-Based Data Synthesis for Scene Text RecognitionXingsong Ye, Yongkun Du, Yunbo Tao, Zhineng ChenICCV 2025 · 4 citations
- TextMaster: A Unified Framework for Realistic Text Editing via Glyph-Style Dual-ControlZhenyu Yan, Jian Wang, Aoqiang Wang, Yuhan Li et al.ICCV 2025 · 4 citations
- UM-Text: A Unified Multimodal Model for Image Understanding and Visual Text EditingLichen Ma, Xiaolong Fu, Gaojing Zhou, Zipeng Guo et al.AAAI 2026 · 1 citation
- SkyReels-Text: Fine-Grained Font-Controllable Text Editing for Poster DesignYunjie Yu, Jingchen Wu, Junchen Zhu, Chunze Lin et al.CVPR 2026 · 1 citation
Builds on14
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser et al.CVPR 2022 · 13,123 citations
- Photorealistic Text-to-Image Diffusion Models with Deep Language UnderstandingChitwan Saharia, William Chan, Saurabh Saxena, Lala Li et al.NeurIPS 2022 · 8,965 citations
- TextDiffuser: Diffusion Models as Text PaintersJingye Chen, Yupan Huang, Tengchao Lv, Lei Cui et al.NeurIPS 2023 · 290 citations
- AnyText: Multilingual Visual Text Generation and EditingYuxiang Tuo, Wangmeng Xiang, Jun-Yan He, Yifeng Geng et al.ICLR 2024 · 148 citations
- Multiple Heads are Better than One: Few-shot Font Generation with Multiple Localized ExpertsSong Park, Sanghyuk Chun, Junbum Cha, Bado Lee et al.ICCV 2021 · 96 citations
Related papers
- Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image SynthesisJian Han, Jinlai Liu, Yi Jiang, Bin Yan et al.CVPR 2025
- DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven GenerationNataniel Ruiz, Yuanzhen Li, Varun Jampani, Yael Pritch et al.CVPR 2023
- RAVE: Randomized Noise Shuffling for Fast and Consistent Video Editing with Diffusion ModelsOzgur Kara, Bariscan Kurtkaya, Hidir Yesiltepe, James M. Rehg et al.CVPR 2024
- Customize your NeRF: Adaptive Source Driven 3D Scene Editing via Local-Global Iterative TrainingRunze He, Shaofei Huang, Xuecheng Nie, Tianrui Hui et al.CVPR 2024
- NitroFusion: High-Fidelity Single-Step Diffusion through Dynamic Adversarial TrainingDar-Yen Chen, Hmrishav Bandyopadhyay, Kai Zou, Yi-Zhe SongCVPR 2025
