Learning Disentangled Identifiers for Action-Customized Text-to-Image Generation
Siteng Huang, Biao Gong, Yutong Feng, Xi Chen, Yuqian Fu, Yu Liu, Donglin Wang
2024年份
15顶会引用
摘要
<A> "A boy <A>" "Spiderman <A>" "Messi <A>" "A gorilla <A>" "A bear <A>" "A panda <A>" Sample Images "An old man <A>" "Batman <A>" <A> "Barack Obama <A>" "A monkey <A>" "A polar bear <A>" "A cat <A>" Sample Images <A> "A woman <A>" "David Beckham <A>" "Michael Jackson <A>" "A dog <A>" "A fox <A>" "A cheetah <A>" Sample Images Figure 1 . Action customization results of our ADI method. By inverting representative action-related features, the learned identifiers "<A>" can be paired with a variety of characters and animals to contribute to the generation of accurate, diverse and high-quality images.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper15
- Identity Decoupling for Multi-Subject Personalization of Text-to-Image ModelsSangwon Jang, Jaehyeong Jo, Kimin Lee, Sung Ju HwangNeurIPS 2024 · 被引用 42 次
- ResMaster: Mastering High-Resolution Image Generation via Structural and Fine-Grained GuidanceShuwei Shi, Wenbo Li, Yuechen Zhang, Jingwen He 等AAAI 2025 · 被引用 23 次
- Action Imitation in Common Action Space for Customized Action Image SynthesisWang Lin, Jingyuan Chen, Jiaxin Shi, Zirun Guo 等NeurIPS 2024 · 被引用 17 次
- Lay2Story: Extending Diffusion Transformers for Layout-Togglable Story GenerationAo Ma, Jiasong Feng, Ke Cao, Jing Wang 等ICCV 2025 · 被引用 13 次
- Seg2Any: Open-set Segmentation-Mask-to-Image Generation with Precise Shape and Semantic ControlDanfeng Li, Hui Zhang, Sheng Wang, Jiacheng Li 等NeurIPS 2025 · 被引用 11 次
它引用的顶会 Paper18
- Learning Transferable Visual Models From Natural Language SupervisionAlec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh 等ICML 2021 · 被引用 47,906 次
- Denoising Diffusion Probabilistic ModelsJonathan Ho, Ajay Jain, Pieter AbbeelNeurIPS 2020 · 被引用 35,902 次
- Diffusion Models Beat GANs on Image SynthesisPrafulla Dhariwal, Alexander Quinn NicholNeurIPS 2021 · 被引用 13,211 次
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser 等CVPR 2022 · 被引用 13,123 次
- Denoising Diffusion Implicit ModelsJiaming Song, Chenlin Meng, Stefano ErmonICLR 2021 · 被引用 11,743 次
相关 Paper
- Event-Customized Image GenerationZhen Wang, Yilei Jiang, Dong Zheng, Jun Xiao 等ICML 2025
- Articulated Kinematics Distillation from Video Diffusion ModelsXuan Li, Qianli Ma, Tsung-Yi Lin, Yongxin Chen 等CVPR 2025
- CapHuman: Capture Your Moments in Parallel UniversesChao Liang, Fan Ma, Linchao Zhu, Yingying Deng 等CVPR 2024
- IMAGINE: Image Synthesis by Image-Guided Model InversionPei Wang, Yijun Li, Krishna Kumar Singh, Jingwan Lu 等CVPR 2021
- FlexiAct: Towards Flexible Action Control in Heterogeneous ScenariosShiyi Zhang, Junhao Zhuang, Zhaoyang Zhang, Ying Shan 等SIGGRAPH 2025 · 被引用 8 次
