HPDCComputer Architecture / Parallel & Distributed Computing / Storage Systems
International ACM Symposium on High-Performance Parallel and Distributed Computing
169已索引 Paper
2020-2026覆盖年份
最新论文
- A Fully GPU-Accelerated Framework for High-Performance Configuration Interaction Selection with Neural Network Quantum StatesDaran Sun, Bowen Kan, Haoquan Long, Hairui Zhao 等2026
- A High-Performance Persistent Transactional Memory System via Cooperative Concurrency ControlHao Hu, Xinrui Zheng, Yizou Chen, Xiangyu Zou 等2026
- Accelerating Block Low-Rank Foundation Model Inference on Memory-Constrained GPUsPierre Abillama, Changwoo Lee, Juechu Dong, David T. Blaauw 等2026
- ATLAS: Efficient Out-of-Core Inference for Billion-Scale Graph Neural NetworksPranjal Naman, Yogesh Simmhan2026
- BCCE: Block-Centric GPU Co-Design for Real-Time Range-Top-K Query at ScaleChengying Huan, Ziheng Meng, Zhengyi Yang, Yongchao Liu 等2026
- Bridging Information Theory and Practice for Scientific Lossy CompressionSujata Sinha, Sheng Di, Vishwas Rao, Robert Underwood 等2026
- CARBS: Compiler Autotuning via Randomized Biased SearchWei Li, Bin Gao, Weng-Fai Wong2026
- Cremes: Cost-Efficient and Reliable Microservice Execution on Spot InstancesLiao Chen, Chenyu Lin, Junlin Chen, Shutian Luo 等2026
- DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State ReuseYuyang Chen, Runxin Zhong, Zan Zong, Hengjie Li 等2026
- Dynamo-MoE: Accelerating Sparse Large Model Inference with Dynamic ParallelizationJiahao Chen, Shigang Li, Rongtian Fu, Tong Wu 等2026
- Efficient Tracking of Communities on Evolving Graphs with Leiden AlgorithmSubhajit Sahu2026
- Enabling Floating Point Virtualization With Tiny NumbersKevin Hayes, Peter A. Dinda2026
- Enabling High-Utilization and Low-Contention FaaS: A Request-Level Resource Provisioning ApproachRunfu Li, Zishu Yu, Yifan Wang, Xiaohui Peng 等2026
- Endeavor: Efficient PairHMM for Detection of DNA Variants in Genome-Scale DatasetsMiguel Graça, Aleksandar Ilic2026
- FAME: A Framework for Accelerating Independent Multi-Agent Reinforcement Learning on Heterogeneous PlatformsSamuel Wiggins, Nikunj Gupta, Grace Zgheib, Mahesh A. Iyer 等2026 · 被引用 1 次
- Full-Core Fluid-Structure-Interaction Simulation of Nuclear Reactor on CPU+GPU Hybrid ClustersXue Miao, Jue Wang, Qida Lin, Shufei Zhang 等2026
- GICC: A High-Performance Runtime for GPU-Initiated Communication and Coordination in Modern HPC SystemsBaodi Shan, Mauricio Araya-Polo, Barbara M. Chapman2026
- GLANCED-IO: Taming I/O Optimization for Deep Learning at ScaleRay A. O. Sinurat, William Nixon, Philip H. Carns, Huihuo Zheng 等2026
- JANUS: Resilient and Adaptive Data Transmission for Enabling Timely and Efficient Cross-Facility Scientific WorkflowsVladislav Esaulov, Jieyang Chen, Norbert Podhorszki, Fred Suter 等2026
- Krysha: Cost-Efficient Resource Orchestration for Geo-Distributed Serverless MicroservicesYuqiu Zhang, Hans-Arno Jacobsen2026
- Merkle-Tree Weight Snapshot Deduplication for Provenance-Aware Auditing of Neural Network TrainingKin Wai Ng, Francesco Antici, Nigel Tan, Befikir Bogale 等2026
- MoE-Lens: Towards the Hardware Limit of High-Throughput MoE LLM Serving Under Resource ConstraintsYichao Yuan, Lin Ma, Nishil Talati2026
- Omnia: Efficient RAG Serving through Speculative SchedulingRongtian Fu, Shigang Li, Youxuan Xu, Tong Wu 等2026
- OPAL: On-demand Progressive Accelerated Scientific Lossy CompressionLongtao Zhang, Ruoyu Li, Zhuoxun Yang, Robert Underwood 等2026 · 被引用 1 次
