DSPlacer: DSP Placement for FPGA-based CNN Accelerator
Baohui Xie, Xinrui Zhu, Zhiyuan Lu, Yuan Pu, Tongkai Wu, Xiaofeng Zou, Bei Yu, Tinghuan Chen
摘要
Deploying convolutional neural networks (CNNs) on hardware platforms like Field Programmable Gate Arrays (FPGAs) has garnered significant attention due to their inherent flexibility and parallelism. Achieving optimal timing closure remains a critical challenge, as placement directly impacts clock frequency and throughput. Existing approaches often face scalability issues with large designs or fail to formalize placement rules into automated algorithms. In this paper, we propose DSPlacer, a novel DSP placement framework designed for diverse CNN accelerator architectures in the context of FPGA design. The proposed approach iteratively optimizes the placement of datapath DSPs to enhance timing performance. To achieve this, DSPlacer integrates several advanced techniques, including graph convolutional network-based datapath DSP identification, DSP graph construction, min-cost-flow DSP assignment, and integer linear programming (ILP)-based cascade constraint legalization. These techniques collectively address two key requirements for datapath DSP placement: (1) cascading datapath DSPs to achieve a compact layout, and (2) preserving direct datapath information between the processing system and programmable logic. The framework has been evaluated on multiple academic benchmarks and compared against AMD Xilinx Vivado 2020.2 and AMF-Placer 2.0. Experimental results demonstrate that DSPlacer improves Worst Negative Slack (WNS) by 32% and 65%, respectively, highlighting its efficacy and superiority.
问问这篇 Paper
智能体会读完全文。
Lune 把这篇 Paper 索引到了每一个公式,引用它的顶会 Paper 也一样。你提问,回答直接引用原文。
相关 Paper
- Differentiable-timing-driven global placementZizheng Guo, Yibo LinDAC 2022 · 被引用 42 次
- VLSI Structure-aware Placement for Convolutional Neural Network Accelerator UnitsYun Chou, Jhih-Wei Hsu, Yao-Wen Chang, Tung-Chieh ChenDAC 2021 · 被引用 11 次
- Xplace: an extremely fast and extensible global placement frameworkLixin Liu, Bangqi Fu, Martin D. F. Wong, Evangeline F. Y. YoungDAC 2022 · 被引用 29 次
- CNN-inspired analytical global placement for large-scale heterogeneous FPGAsHuimin Wang, Xingyu Tong, Chenyue Ma, Runming Shi 等DAC 2022 · 被引用 8 次
- CODO: An Automated Compiler for Comprehensive Dataflow OptimizationWeichuang Zhang, Yiquan Wang, Xinzhou Zhang, Chi Zhang 等ISCA 2026
