Minority-Focused Text-to-Image Generation via Prompt Optimization
Soobin Um, Jong Chul Ye
Abstract
Figure 1 . Example results from our minority generation approach using SDXL-Lightning. Our framework is designed to produce unique minority samples w.r.t. user-provided prompts, which are rarely generated by standard samplers like DDIM [46] . Due to its low-likelihood encouraging nature, our sampler often demonstrates counteracting results against demographic biases in text-to-image models [13] . See the samples in the last row for instance, where our sampler mitigates prevalent age and racial biases (e.g., associating "man" with "young" and "woman" with "white") by modifying the demographic traits of the subjects.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext c074f511-62ea-4f23-aaae-d325a689afd9Cited by top-tier papers9
- Diverse Text-to-Image Generation via Contrastive Noise OptimizationByungjun Kim, Soobin Um, Jong Chul YeICLR 2026 · 11 citations
- Diffusion Adaptive Text Embedding for Text-to-Image Diffusion ModelsByeonghu Na, Minsang Park, Gyuwon Sim, Donghyeok Shin et al.NeurIPS 2025 · 8 citations
- DMGD: Train-Free Dataset Distillation with Semantic-Distribution Matching in Diffusion ModelsQichao Wang, Yunhong Lu, Hengyuan Cao, Junyi Zhang et al.CVPR 2026 · 4 citations
- On-the-fly Repulsion in the Contextual Space for Rich Diversity in Diffusion TransformersOmer Dahary, Benaya Koren, Daniel Garibi, Daniel Cohen-OrSIGGRAPH 2026 · 1 citation
- Beyond Generative Priors: Minority Sampling with JEPA-Guided DiffusionSol Park, Soobin UmICML 2026
Builds on32
- Learning Transferable Visual Models From Natural Language SupervisionAlec Radford, Jong Wook Kim, Chris Hallacy, Aditya Ramesh et al.ICML 2021 · 47,906 citations
- Denoising Diffusion Probabilistic ModelsJonathan Ho, Ajay Jain, Pieter AbbeelNeurIPS 2020 · 35,902 citations
- High-Resolution Image Synthesis with Latent Diffusion ModelsRobin Rombach, Andreas Blattmann, Dominik Lorenz, Patrick Esser et al.CVPR 2022 · 13,123 citations
- Denoising Diffusion Implicit ModelsJiaming Song, Chenlin Meng, Stefano ErmonICLR 2021 · 11,743 citations
- Emerging Properties in Self-Supervised Vision TransformersMathilde Caron, Hugo Touvron, Ishan Misra, Hervé Jégou et al.ICCV 2021 · 8,921 citations
Related papers
- Don't Play Favorites: Minority Guidance for Diffusion ModelsSoobin Um, Suhyeon Lee, Jong Chul YeICLR 2024 · 37 citations
- Rethinking Training for De-biasing Text-to-Image Generation: Unlocking the Potential of Stable DiffusionEunji Kim, Siwon Kim, Minjun Park, Rahim Entezari et al.CVPR 2025
- ITI-Gen: Inclusive Text-to-Image GenerationCheng Zhang, Xuanbai Chen, Siqi Chai, Chen Henry Wu et al.ICCV 2023 · 89 citations
- RAIGen: Rare Attribute Identification in Text-to-Image Generative ModelsSilpa Vadakkeeveetil Sreelatha, Dan Wang, Serge Belongie, Muhammad Awais et al.ICML 2026
- Fair Text-to-Image Diffusion via Fair MappingJia Li, Lijie Hu, Jingfeng Zhang, Tianhang Zheng et al.AAAI 2025 · 36 citations
