SCComputer Architecture / Parallel & Distributed Computing / Storage Systems
International Conference for High Performance Computing, Networking, Storage, and Analysis
597已索引 Paper
2020-2025覆盖年份
最新论文
- A Nested Krylov Method Using Half-Precision ArithmeticKengo Suzuki, Takeshi Iwashita2025 · 被引用 1 次
- A Sample-Free Compilation Framework for Efficient Dynamic Tensor ComputationYangjie Zhou, Honglin Zhu, Qian Qiu, Weihao Cui 等2025 · 被引用 3 次
- A Streaming Collectives Interface Targeting Dataflow Acceleration and HPC WorkloadsNicholas Contini, Jake Queiser, Bharath Ramesh, Hari Subramoni 等2025 · 被引用 1 次
- Accelerated Spatio-Temporal Bayesian Modeling for Multivariate Gaussian ProcessesLisa Gaedke-Merzhäuser, Vincent Maillou, Fernando Rodriguez Avellaneda, Olaf Schenk 等2025 · 被引用 2 次
- ACTINA: Adapting Circuit-Switching Techniques for AI Networking ArchitecturesZhenguo Wu, Benjamin Klenk, Larry Dennison, Keren Bergman2025 · 被引用 4 次
- Addressing Reproducibility Challenges in HPC with Continuous IntegrationValérie Hayot-Sasson, Nathaniel Hudson, André Bauer, Maxime Gonthier 等2025 · 被引用 1 次
- AGILE: Lightweight and Efficient Asynchronous GPU-SSD IntegrationZhuoping Yang, Jinming Zhuang, Xingzhen Chen, Alex K. Jones 等2025 · 被引用 3 次
- AMRaCut: Scalable Partitioning for Adaptive Mesh RefinementBudvin Edippuliarachchi, David Van Komen, Hari Sundar2025 · 被引用 1 次
- ATLAHS: An Application-centric Network Simulator Toolchain for AI, HPC, and Distributed StorageSiyuan Shen, Tommaso Bonato, Zhiyi Hu, Pasquale Jordan 等2025 · 被引用 7 次
- Augmenting Simulated Noisy Quantum Data Collection by Orders of Magnitude Using Pre-Trajectory Sampling with Batched ExecutionTaylor Lee Patti, Thien Nguyen, Justin Gage Lietz, Alex McCaskey 等2025 · 被引用 2 次
- Automatic Generation of Mappings for Distributed Fourier OperationsDoru-Thom Popovici, Botao Wu, John Shalf, Martin Kong2025 · 被引用 3 次
- Balanced and Elastic End-to-end Training of Dynamic LLMsMohamed Wahib, Muhammed Abdullah Soyturk, Didem Unat2025 · 被引用 3 次
- Benchmark-driven Models for Energy Analysis and Attribution of GPU-Accelerated SupercomputingOscar Antepara, Zhengji Zhao, Brian Austin, Nan Ding 等2025 · 被引用 5 次
- Bine Trees: Enhancing Collective Operations by Optimizing Communication LocalityDaniele De Sensi, Saverio Pasqualoni, Lorenzo Piarulli, Tommaso Bonato 等2025 · 被引用 4 次
- BLAZE: Exploiting Hybrid Parallelism and Size-customized Kernels to Accelerate BLASTP on GPUsSree Charan Gundabolu, Mithuna Thottethodi, T. N. Vijaykumar2025 · 被引用 1 次
- BOER: Enhancing Resource Utilization for Deep Learning Inference with Hybrid Spatial GPU SharingBowen Zhang, Yuhang Wang, Zhuozhao Li2025 · 被引用 4 次
- Boosting Scientific Error-Bounded Lossy Compression through Optimized Synergistic Lossy-Lossless OrchestrationShixun Wu, Jinwen Pan, Jinyang Liu, Jiannan Tian 等2025 · 被引用 6 次
- Breaking the System Noise Barrier at ExascaleEdgar A. León, Joseph Glenski, Mark J. Stock, Kim H. McMahon 等2025 · 被引用 1 次
- Bridging the Gap Between Binary and Source Based Package Management in SpackJohn Gouwar, Gregory Becker, Tamara Dahlgren, Nathan Hanford 等2025 · 被引用 1 次
- Bridging the Gap between Unstructured SpMM and Structured Sparse Tensor CoresYukang Dong, Ziyuan Shen, Wenbin Jiang, Zhenghang Liu 等2025 · 被引用 4 次
- Bubble: Towards Scalable Evolving Graph Processing via Mini-Batch SortingLong Deng, Yongkun Li, Zaigui Zhang, Yinlong Xu 等2025 · 被引用 3 次
- BurstEngine: An efficient distributed framework for training transformers On extremely Long sequences of over 1M tokensAo Sun, Weilin Zhao, Xu Han, Cheng Yang 等2025 · 被引用 1 次
- C.A.T.S.: Memory and Control Flow Tracing for Whole-Program Performance AnalysisPhilipp Schaad, Tal Ben-Nun, Torsten Hoefler2025 · 被引用 1 次
- Caracal: A GPU-Resident Sparse LU Solver with Lightweight Fine-Grained SchedulingJie Ren, Tingxuan Zhong, Yuxi Hong, Guofeng Feng 等2025 · 被引用 1 次
