ISCAComputer Architecture / Parallel & Distributed Computing / Storage Systems
International Symposium on Computer Architecture
674已索引 Paper
2020-2026覆盖年份
最新论文
- -LLM: An Integrated NPU-PIM Accelerator for Edge LLM Inference Using Hybrid Numerical FormatsYuzong Chen, Chao Fang, Xilai Dai, Yuheng Wu 等2026 · 被引用 4 次
- RNG: A Framework for Assessing Randomness in Intermittent Computing DevicesPrakhar Sah, Matthew Hicks2026
- A Streaming Architecture for Quantum Error Syndrome Compression at 4 KelvinPanagiotis Papanikolaou, Ryan Hou, Jennifer Volk, George Tzimpragos2026 · 被引用 2 次
- Accelerating MoE with Dynamic In-Switch Computing on Multi-GPUsQijun Zhang, Chen Zhang, Zhuoshan Zhou, Haibo Wang 等2026
- Accelerator Polymorphism: Transcending Domain-Specific Architectures with RoboticsHanyang Xu, Seongryong Oh, Yubin Lee, Ashwin Rohit Alagiri Rajan 等2026
- æSIP: μArch-Aware ASIP-ISA Co-Design via Program Synthesis, Equality Saturation, and External Don't CaresHaoran Jin, Jirong Yang, Barry Lyu, Ruijie Gao 等2026
- Approaching Shannon Bound with Lossless LLM Weight CompressionHongshi Tan, Yao Chen, Gustavo Alonso, Weng-Fai Wong 等2026 · 被引用 2 次
- AQuant: Repurposing CODEC for VLM Acceleration via Adaptive QuantizationZhuoran Song, Chunyu Qi, Jian Weng, Xiaoyao Liang 等2026
- ATX: Accelerator Task ExtensionsGerasimos Gerogiannis, Stijn Eyerman, Josep Torrellas, Wim Heirman2026
- Augmenting the Branch Predictor with a Squashed-Branch Reuse BufferRohit Singh, Jiayang Li, Eric Rotenberg2026
- AutoFHE: An Automatic Hardware Generation Framework for Domain-Specific FHE AcceleratorsYibo Du, Cangyuan Li, Bing Li, Mengdi Wang 等2026
- AXLE: Coordinated Offloading with Asynchronous Back-Streaming in Computational Memory SystemsSuyeon Lee, Kangkyu Park, Kwangsik Shin, Ada Gavrilovska2026
- BAAP: Coupling Compute-in-SRAM with DRAM Banks for Near-Memory ProcessingCecilio C. Tamarit, Socrates S. Wong, Akshati Vaishnav, José F. Martínez2026
- Breaking Barriers in Atomic Scaling: A Hardware-Software-Collaborated Framework to Deconstruct RDMA AtomicGuangyang Deng, Qiangsheng Su, Zhirong Shen, Qing Wang 等2026
- Bridging Efficiency and Scalability in Llm System Via 3D Hybrid Pim With 2D in-Transit ComputationHongyi Li, Songchen Ma, Huanyu Qu, Weihao Zhang 等2026
- Bringing Near Data Processing Into the Low-Bit Floating-Point EraTongxin Xie, Mingyu Gao, Zehao Wang, Zhihao Jia 等2026
- BulletTime: Time Dilation for High-Fidelity TracingMichael Wu, Sibren Isaacman, Abhishek Bhattacharjee, Anurag Khandelwal2026
- Bumper: Hinting Instruction Usefulness for Robust Unified CachesGeorgios Vavouliotis, Tom Rollet, Davide Basilio Bartolini, Boris Grot 等2026
- CAPA: Manufacturing Carbon Estimation for Advanced-Packaged ArchitecturesJingyang Liu, Gwenith Bowker-Bafna, Yuke Zhang, Natalie Enright Jerger2026
- Cassandra: Enabling Reasoning LLMs at Edge via Self-Speculative DecodingSoongyu Choi, Yuntae Kim, Muyoung Son, Joo-Young Kim2026
- Cerberus: Cross-Layer ECC Co-Design for Robust and Efficient Memory ProtectionJunhwan Kim, Seunghyun Kim, Yesin Ryu, Saeid Gorgin 等2026 · 被引用 1 次
- CHIME: A Case for Efficient Long-Context Attention-FC Disaggregated Inference with DIMM-PIMQingyuan Liu, Liyan Chen, Haocheng Wang, Yanning Yang 等2026 · 被引用 6 次
- Coarse-Grained Duplication First, Fine-Grained Deduplication Later: Duplication-Centric Multi-GPU Memory ManagementXiangyue Huang, Yanan Guo, Yuanchao Xu2026
- CODO: An Automated Compiler for Comprehensive Dataflow OptimizationWeichuang Zhang, Yiquan Wang, Xinzhou Zhang, Chi Zhang 等2026
