SwiftPillars: High-Efficiency Pillar Encoder for Lidar-Based 3D Detection
Xin Jin, Kai Liu, Cong Ma, Ruining Yang, Fei Hui, Wei Wu
Abstract
Lidar-based 3D Detection is one of the significant components of Autonomous Driving. However, current methods over-focus on improving the performance of 3D Lidar perception, which causes the architecture of networks becoming complicated and hard to deploy. Thus, the methods are difficult to apply in Autonomous Driving for real-time processing. In this paper, we propose a high-efficiency network, SwiftPillars, which includes Swift Pillar Encoder (SPE) and Multi-scale Aggregation Decoder (MAD). The SPE is constructed by a concise Dual-attention Module with lightweight operators. The Dual-attention Module utilizes feature pooling, matrix multiplication, etc. to speed up point-wise and channel-wise attention extraction and fusion. The MAD interconnects multiple scale features extracted by SPE with minimal computational cost to leverage performance. In our experiments, our proposal accomplishes 61.3% NDS and 53.2% mAP in nuScenes dataset. In addition, we evaluate inference time on several platforms (P4, T4, A2, MLU370, RTX3080), where SwiftPillars achieves up to 13.3ms (75FPS) on NVIDIA Tesla T4. Compared with PointPillars, SwiftPillars is on average 26.58% faster in inference speed with equivalent GPUs and a higher mAP of approximately 3.2% in the nuScenes dataset.
Ask about this paper
Your agent reads all of it.
Lune indexed this paper to the last equation, along with the top-tier papers that cite it. Ask a question and the answer quotes them.
Your agent calls
Luneget_paper_fulltext
Free to start. No credit card required.
Terminal
Install the CLIlune papers fulltext 2b24c87a-0e52-4e73-8435-0ee2a3350fe2Cited by top-tier papers4
- Towards Learning Group-Equivariant Features for Domain Adaptive 3D DetectionSangyun Shin, Yuhang He, Madhu Vankadari, Ta Ying Cheng et al.NeurIPS 2024 · 5 citations
- GeoFormer: Geometry Point Encoder for 3D Object Detection with Graph-Based TransformerXin Jin, Haisheng Su, Cong Ma, Kai Liu et al.ICCV 2025 · 2 citations
- Equirectangular Point Reconstruction for Domain Adaptive Multimodal 3D Object Detection in Adverse Weather ConditionsJae Hyun Yoon, Jong Won Jung, Seok Bong YooAAAI 2025 · 1 citation
- DiffRefine: Diffusion-Based Proposal Specific Point Cloud Densification for Cross-Domain Object DetectionSangyun Shin, Yuhang He, Xinyu Hou, Samuel Hodgson et al.ICCV 2025 · 1 citation
Builds on27
- Deep Hough Voting for 3D Object Detection in Point CloudsCharles R. Qi, Or Litany, Kaiming He, Leonidas J. GuibasICCV 2019 · 1,467 citations
- Voxel R-CNN: Towards High Performance Voxel-based 3D Object DetectionJiajun Deng, Shaoshuai Shi, Peiwei Li, Wengang Zhou et al.AAAI 2021 · 1,128 citations
- TransFusion: Robust LiDAR-Camera Fusion for 3D Object Detection with TransformersXuyang Bai, Zeyu Hu, Xinge Zhu, Qingqiu Huang et al.CVPR 2022 · 794 citations
- DAIR-V2X: A Large-Scale Dataset for Vehicle-Infrastructure Cooperative 3D Object DetectionHaibao Yu, Yizhen Luo, Mao Shu, Yiyi Huo et al.CVPR 2022 · 475 citations
- TANet: Robust 3D Object Detection from Point Clouds with Triple AttentionZhe Liu, Xin Zhao, Tengteng Huang, Ruolan Hu et al.AAAI 2020 · 412 citations
Related papers
- SPADE: Sparse Pillar-based 3D Object Detection Accelerator for Autonomous DrivingMinjae Lee, Seongmin Park, Hyungmin Kim, Minyong Yoon et al.HPCA 2024 · 17 citations
- PillarNeXt: Rethinking Network Designs for 3D Object Detection in LiDAR Point CloudsJinyu Li, Chenxu Luo, Xiaodong YangCVPR 2023
- Voxel or Pillar: Exploring Efficient Point Cloud Representation for 3D Object DetectionYuhao Huang, Sanping Zhou, Junjie Zhang, Jinpeng Dong et al.AAAI 2024 · 12 citations
- LiDAR R-CNN: An Efficient and Universal 3D Object DetectorZhichao Li, Feng Wang, Naiyan WangCVPR 2021
- Neural Pruning Search for Real-Time Object Detection of Autonomous VehiclesPu Zhao, Geng Yuan, Yuxuan Cai, Wei Niu et al.DAC 2021 · 23 citations
