Unveil Inversion and Invariance in Flow Transformer for Versatile Image Editing
Pengcheng Xu, Boyuan Jiang, Xiaobin Hu, Donghao Luo, Qingdong He, Jiangning Zhang, Chengjie Wang, Yunsheng Wu, Charles Ling, Boyu Wang
2025Year
15Top-tier citations
Abstract
Mountain → City Remove moon Gold chain and star Cartoon Figure 1. Our framework reconciles the invariance control for rigid and non-rigid editing, enabling versatile editing via flow transformer.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 82c4f6da-e373-4a54-8505-62200246556aCited by top-tier papers15
- DNAEdit: Direct Noise Alignment for Text-Guided Rectified Flow EditingChenxi Xie, Minghan Li, Shuai Li, Yuhui Wu et al.NeurIPS 2025 · 27 citations
- SplitFlow: Flow Decomposition for Inversion-Free Text-to-Image EditingSung-Hoon Yoon, Minghan Li, Gaspard Beaudouin, Congcong Wen et al.NeurIPS 2025 · 18 citations
- FreeViS: Training-free Video Stylization with Inconsistent ReferencesJiacong Xu, Yiqun Mei, Ke Zhang, Vishal M. PatelICLR 2026 · 7 citations
- Free Lunch for Stabilizing Rectified Flow InversionChenru Wang, Beier Zhu, Chi ZhangICLR 2026 · 6 citations
- Training-Free Text-Guided Color Editing with Multi-Modal Diffusion TransformerZixin Yin, Xili Dai, Ling-Hao Chen, Deyu Zhou et al.ICLR 2026 · 6 citations
Builds on38
- Denoising Diffusion Probabilistic ModelsJonathan Ho, Ajay Jain, Pieter AbbeelNeurIPS 2020 · 35,902 citations
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser et al.CVPR 2022 · 13,123 citations
- Denoising Diffusion Implicit ModelsJiaming Song, Chenlin Meng, Stefano ErmonICLR 2021 · 11,743 citations
- Photorealistic Text-to-Image Diffusion Models with Deep Language UnderstandingChitwan Saharia, William Chan, Saurabh Saxena, Lala Li et al.NeurIPS 2022 · 8,965 citations
- Adding Conditional Control to Text-to-Image Diffusion ModelsLvmin Zhang, Anyi Rao, Maneesh AgrawalaICCV 2023 · 6,759 citations
Related papers
- Stable Flow: Vital Layers for Training-Free Image EditingOmri Avrahami, Or Patashnik, Ohad Fried, Egor Nemchinov et al.CVPR 2025
- QK-Edit: Revisiting Attention-based Injection in MM-DiT for Image and Video EditingTiancheng Shen, Zilong Huang, Xiangtai Li, Zhijie Lin et al.ICCV 2025 · 2 citations
- Cora: Correspondence-aware image editing using few step diffusionAmirhossein Alimohammadi, Aryan Mikaeili, Sauradip Nag, Negar Hassanpour et al.SIGGRAPH 2025
- FlowVid: Taming Imperfect Optical Flows for Consistent Video-to-Video SynthesisFeng Liang, Bichen Wu, Jialiang Wang, Licheng Yu et al.CVPR 2024
- RIGID: Recurrent GAN Inversion and Editing of Real Face VideosYangyang Xu, Shengfeng He, Kwan-Yee K. Wong, Ping LuoICCV 2023 · 14 citations
