Visual Instruction Inversion: Image Editing via Image Prompting
Thao Nguyen, Yuheng Li, Utkarsh Ojha, Yong Jae Lee
2023年份
53被引次数
19顶会引用
摘要
Test Image Before After "Turn it into a watercolor painting" Instruction + "… husky" + "… pit bull" + "… tiger" + "… monkey" + "… squirrel" Instruction InstructPix2Pix Ours Test Image <ins> + "… husky" + "… pit bull" + "… tiger"
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper19
- ImageRAG: Dynamic Image Retrieval for Reference-Guided Image GenerationRotem Shalev-Arkushin, Rinon Gal, Amit Bermano, Ohad FriedICLR 2026 · 被引用 25 次
- ParallelEdits: Efficient Multi-Aspect Text-Driven Image Editing with Attention GroupingMingzhen Huang, Jialing Cai, Shan Jia, Vishnu Suresh Lokhande 等NeurIPS 2024 · 被引用 19 次
- OneActor: Consistent Subject Generation via Cluster-Conditioned GuidanceJiahao Wang, Caixia Yan, Haonan Lin, Weizhan Zhang 等NeurIPS 2024 · 被引用 16 次
- 3DOT: Texture Transfer for 3DGS Objects from a Single Reference ImageXiao Cao, Beibei Lin, Bo Wang, Zhiyong Huang 等NeurIPS 2025 · 被引用 8 次
- Analogist: Out-of-the-box Visual In-Context Learning with Image Diffusion ModelZheng Gu, Shiyuan Yang, Jing Liao, Jing Huo 等SIGGRAPH 2024 · 被引用 7 次
它引用的顶会 Paper33
- Language Models are Few-Shot LearnersTom B. Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah 等NeurIPS 2020 · 被引用 64,255 次
- Learning Transferable Visual Models From Natural Language SupervisionAlec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh 等ICML 2021 · 被引用 47,906 次
- Denoising Diffusion Probabilistic ModelsJonathan Ho, Ajay Jain, Pieter AbbeelNeurIPS 2020 · 被引用 35,902 次
- Diffusion Models Beat GANs on Image SynthesisPrafulla Dhariwal, Alexander Quinn NicholNeurIPS 2021 · 被引用 13,211 次
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser 等CVPR 2022 · 被引用 13,123 次
相关 Paper
- UniGen-1.5: Enhancing Image Generation and Editing through Reward Unification in RLRui Tian, Mingfei Gao, Haiming Gang, Jiasen Lu 等CVPR 2026
- Multi-Concept Customization of Text-to-Image DiffusionNupur Kumari, Bingliang Zhang, Richard Zhang, Eli Shechtman 等CVPR 2023
- SmartEdit: Exploring Complex Instruction-Based Image Editing with Multimodal Large Language ModelsYuzhou Huang, Liangbin Xie, Xintao Wang, Ziyang Yuan 等CVPR 2024
- HIVE: Harnessing Human Feedback for Instructional Visual EditingShu Zhang, Xinyi Yang, Yihao Feng, Can Qin 等CVPR 2024
- IMAGINE: Image Synthesis by Image-Guided Model InversionPei Wang, Yijun Li, Krishna Kumar Singh, Jingwan Lu 等CVPR 2021
