PPoPPComputer Architecture / Parallel & Distributed Computing / Storage Systems
ACM SIGPLAN Symposium on Principles and Practice of Parallel Programming
240Papers indexed
2020-2026Years covered
Recent papers
- A Diagonal Block Memory-Aware Polynomial Preconditioner for Linear and Eigenvalue SolversXiaojian Yang, Yuhui Ni, Fan Yuan, Shengguo Li et al.2026 · 1 citation
- A Distributed Matrix-Block-Vector Multiplication in Presence of System Performance VariabilityYuchen Ma, Bin Ren, Andreas Stathopoulos2026
- Accelerating Sparse Transformer Inference on GPUWenhao Dai, Haodong Deng, Mengfei Rong, Xinyu Yang et al.2026 · 1 citation
- APERTURE: Algorithm-System Co-optimization for Temporal Graph Network InferenceYiqing Wang, Hailong Yang, Enze Yu, Qingxiao Sun et al.2026
- ASM-SpMM: Unleashing the Potential of Arm SME for Sparse Matrix Multiplication AccelerationJiazhi Jiang, Xijia Yao, Jiayu Chen, Jinhui Wei et al.2026
- BEEMS: Boosting Machine Vision Efficiency via Computation Graph-Based Memory SmoothingHanjing Shen, Fangxin Liu, Jian Liu, Li Jiang et al.2026
- Binary Compatible Critical Section DelegationJunyao Zhang, Zhuo Wang, Zhe Zhou2026
- Cacheman: A Comprehensive Last-Level Cache Management System for Multi-tenant CloudsXiaokang Hu, Yuchao Cao, Naixuan Guan, Yifan Wu et al.2026 · 1 citation
- CCL-D: A High-Precision Diagnostic System for Slow and Hang Anomalies in Large-Scale Model TrainingYida Gu, Fakang Wang, Jianhao Fu, Zhenhang Sun et al.2026
- Characterizing Matrix Multiplication Units across General Parallel Patterns in Scientific ComputingYuechen Lu, Hongwei Zeng, Marc Casas, Weifeng Liu2026 · 1 citation
- ChituDiffusion: A Data-Characteristic-Aware Serving System for Diffusion ModelsChengzhang Wu, Liyan Zheng, Haojie Wang, Kezhao Huang et al.2026
- COCCL: A Collective Communication Library Supporting Easy Integration and Configuration of Customized Compression for Scalable LLM TrainingXingchen Liu, Haoran Kong, Hairui Zhao, Shengkai Lyu et al.2026 · 3 citations
- Concurrent Balanced Augmented TreesEvan Wrench, Ajay Singh, Younghun Roh, Panagiota Fatourou et al.2026
- DiggerBees: Depth First Search Leveraging Hierarchical Block-Level Stealing on GPUsYuyao Niu, Yuechen Lu, Weifeng Liu, Marc Casas2026 · 1 citation
- DTMiner: A Data-Centric System for Efficient Temporal Motif MiningYinbo Hou, Hao Qi, Ligang He, Jin Zhao et al.2026
- Dynamic Detection of Inefficient Data Mapping Patterns in Heterogeneous OpenMP ApplicationsLuke Marzen, Junhyung Shim, Ali Jannesari2026
- ElasGNN: An Elastic Training Framework for Distributed GNN TrainingSiqi Wang, Hailong Yang, Pengbo Wang, Hongliang Cao et al.2026
- Elastor: Elastic and Efficient Model Partitioning and Checkpointing for Fault-Tolerant Distributed TrainingXuanyu Wang, Fangcheng Fu, Haoyang Li, Hao Ge et al.2026 · 1 citation
- Exploiting Efficient Mapping and Pipelined Execution for Accelerating SpMV on Tensor CoresKaige Zhang, Hailong Yang, Xin You, Tianyu Feng et al.2026
- Faster and Cheaper: Pushing the Sequence Alignment Throughput with Commercial CPUsZhonghai Zhang, Yewen Li, Ke Meng, Chunming Zhang et al.2026 · 1 citation
- Fixing Non-blocking Data Structures for Better Compatibility with Memory Reclamation SchemesMd Amit Hasan Arovi, Ruslan Nikolaev2026 · 1 citation
- FlashAttention-T: Towards Fully Tensorized Attention by Exploiting Tensor-Vector ParallelismJianxing Xu, Yuanbo Wen, Jun Bi, Ruibai Xu et al.2026
- Hapax Locks: Scalable Value-Based Mutual ExclusionDave Dice, Alex Kogan2026 · 2 citations
- HelixPipe: Efficient Distributed Training of Long Sequence Transformers with Attention Parallel Pipeline ParallelismGeng Zhang, Shenggan Cheng, Xuanlei Zhao, Ziming Liu et al.2026 · 3 citations
