INS-Conv: Incremental Sparse Convolution for Online 3D Segmentation
Leyao Liu, Tian Zheng, Yun-Jou Lin, Kai Ni, Lu Fang
摘要
We propose INS-Conv, an INcremental Sparse Convolutional network which enables online accurate 3D semantic and instance segmentation. Benefiting from the incremental nature of RGB-D reconstruction, we only need to update the residuals between the reconstructed scenes of consecutive frames, which are usually sparse. For layer design, we define novel residual propagation rules for sparse convolution operations, achieving close approximation to standard sparse convolution. For network architecture, an uncertainty term is proposed to adaptively select which residual to update, further improving the inference accuracy and efficiency. Based on INS-Conv, an online joint 3D semantic and instance segmentation pipeline is proposed, reaching an inference speed of 15 FPS on GPU and 10 FPS on CPU. Experiments on ScanNetv2 and SceneNN datasets show that the accuracy of our method surpasses previous online methods by a large margin, and is on par with state-of-the-art offline methods. A live demo on portable devices further shows the superior performance of INS-Conv.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
引用它的顶会 Paper14
- OmniSeg3D: Omniversal 3D Segmentation via Hierarchical Contrastive LearningHaiyang Ying, Yixuan Yin, Jinzhi Zhang, Fan Wang 等CVPR 2024 · 被引用 32 次
- MaskClustering: View Consensus Based Mask Graph Clustering for Open-Vocabulary 3D Instance SegmentationMi Yan, Jiazhao Zhang, Yan Zhu, He WangCVPR 2024 · 被引用 22 次
- ElasticMVS: Learning elastic part representation for self-supervised multi-view stereopsisJinzhi Zhang, Ruofan Tang, Zheng Cao, Jing Xiao 等NeurIPS 2022 · 被引用 10 次
- PanoRecon: Real-Time Panoptic 3D Reconstruction from Monocular VideoDong Wu, Zike Yan, Hongbin ZhaCVPR 2024 · 被引用 8 次
- Online Segment Any 3D Thing as Instance TrackingHanshi Wang, Zijian Cai, Jin Gao, Yiwei Zhang 等NeurIPS 2025 · 被引用 6 次
它引用的顶会 Paper9
- KPConv: Flexible and Deformable Convolution for Point CloudsHugues Thomas, Charles R. Qi, Jean-Emmanuel Deschaud, Beatriz Marcotegui 等ICCV 2019 · 被引用 3,193 次
- 3D Instance Segmentation via Multi-Task Metric LearningJean Lahoud, Bernard Ghanem, Martin R. Oswald, Marc PollefeysICCV 2019 · 被引用 189 次
- Live Semantic 3D Perception for Immersive Augmented RealityLei Han, Tian Zheng, Yinheng Zhu, Lan Xu 等IEEE VR 2020 · 被引用 72 次
- Fusion-Aware Point Convolution for Online Semantic 3D Scene SegmentationJiazhao Zhang, Chenyang Zhu, Lintao Zheng, Kai XuCVPR 2020
- Bidirectional Projection Network for Cross Dimension Scene UnderstandingWenbo Hu, Hengshuang Zhao, Li Jiang, Jiaya Jia 等CVPR 2021
相关 Paper
- Incremental 3D Semantic Scene Graph Prediction from RGB SequencesShun-Cheng Wu, Keisuke Tateno, Nassir Navab, Federico TombariCVPR 2023
- ReScene4D: Temporally Consistent Semantic Instance Segmentation of Evolving Indoor 3D ScenesEmily Steiner, Jianhao Zheng, Henry Howard-Jenkins, Chris Xie 等CVPR 2026 · 被引用 3 次
- Attention-Based Multi-Modal Fusion Network for Semantic Scene CompletionSiqi Li, Changqing Zou, Yipeng Li, Xibin Zhao 等AAAI 2020 · 被引用 68 次
- CAGroup3D: Class-Aware Grouping for 3D Object Detection on Point CloudsHaiyang Wang, Lihe Ding, Shaocong Dong, Shaoshuai Shi 等NeurIPS 2022 · 被引用 110 次
- SoftGroup for 3D Instance Segmentation on Point CloudsThang Vu, Kookhoi Kim, Tung Minh Luu, Thanh Xuan Nguyen 等CVPR 2022 · 被引用 251 次
