MosaicOS: A Simple and Effective Use of Object-Centric Images for Long-Tailed Object Detection
Cheng Zhang, Tai-Yu Pan, Yandong Li, Hexiang Hu, Dong Xuan, Soravit Changpinyo, Boqing Gong, Wei-Lun Chao
摘要
Many objects do not appear frequently enough in complex scenes (e.g., certain handbags in living rooms) for training an accurate object detector, but are often found frequently by themselves (e.g., in product images). Yet, these object-centric images are not effectively leveraged for improving object detection in scene-centric images. In this paper, we propose Mosaic of Object-centric images as Scene-centric images (MOSAICOS), a simple and novel framework that is surprisingly effective at tackling the challenges of long-tailed object detection. Keys to our approach are three-fold: (i) pseudo scene-centric image construction from object-centric images for mitigating domain differences, (ii) high-quality bounding box imputation using the object-centric images' class labels, and (iii) a multi-stage training procedure. On LVIS object detection (and instance segmentation), MOSAICOS leads to a massive 60% (and 23%) relative improvement in average precision for rare object categories. We also show that our framework can be compatibly used with other existing approaches to achieve even further gains. Our pre-trained models are publicly available at https:// github.com/czhang0528/MosaicOS/ .
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了最后一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper14
- On Model Calibration for Long-Tailed Object Detection and Instance SegmentationTai-Yu Pan, Cheng Zhang, Yandong Li, Hexiang Hu 等NeurIPS 2021 · 被引用 56 次
- CLIM: Contrastive Language-Image Mosaic for Region RepresentationSize Wu, Wenwei Zhang, Lumin Xu, Sheng Jin 等AAAI 2024 · 被引用 30 次
- Learning from Rich Semantics and Coarse Locations for Long-tailed Object DetectionLingchen Meng, Xiyang Dai, Jianwei Yang, Dongdong Chen 等NeurIPS 2023 · 被引用 23 次
- Relieving Long-tailed Instance Segmentation via Pairwise Class BalanceYin-Yin He, Peizhen Zhang, Xiu-Shen Wei, Xiangyu Zhang 等CVPR 2022 · 被引用 18 次
- DiffuLT: Diffusion for Long-tail Recognition Without External KnowledgeJie Shao, Ke Zhu, Hanxiao Zhang, Jianxin WuNeurIPS 2024 · 被引用 17 次
它引用的顶会 Paper16
- Decoupling Representation and Classifier for Long-Tailed RecognitionBingyi Kang, Saining Xie, Marcus Rohrbach, Zhicheng Yan 等ICLR 2020 · 被引用 1,496 次
- Rethinking ImageNet Pre-TrainingKaiming He, Ross B. Girshick, Piotr DollárICCV 2019 · 被引用 1,188 次
- Objects365: A Large-Scale, High-Quality Dataset for Object DetectionShuai Shao, Zeming Li, Tianyuan Zhang, Chao Peng 等ICCV 2019 · 被引用 1,018 次
- Balanced Meta-Softmax for Long-Tailed Visual RecognitionJiawei Ren, Cunjun Yu, Shunan Sheng, Xiao Ma 等NeurIPS 2020 · 被引用 861 次
- Frustratingly Simple Few-Shot Object DetectionXin Wang, Thomas E. Huang, Joseph Gonzalez, Trevor Darrell 等ICML 2020 · 被引用 723 次
相关 Paper
- Boosting Long-tailed Object Detection via Step-wise Learning on Smooth-tail DataNa Dong, Yongqiang Zhang, Mingli Ding, Gim Hee LeeICCV 2023 · 被引用 8 次
- SimLTD: Simple Supervised and Semi-Supervised Long-Tailed Object DetectionPhi Vu TranCVPR 2025
- Overcoming Classifier Imbalance for Long-Tail Object Detection With Balanced Group SoftmaxYu Li, Tao Wang, Bingyi Kang, Sheng Tang 等CVPR 2020
- Adaptive Hierarchical Representation Learning for Long-Tailed Object DetectionBanghuai LiCVPR 2022 · 被引用 16 次
- DropLoss for Long-Tail Instance SegmentationTing-I Hsieh, Esther Robb, Hwann-Tzong Chen, Jia-Bin HuangAAAI 2021 · 被引用 53 次
