Abstract is missing.
- Noise Injection for Performance Bottleneck AnalysisAurélien Delval, Pablo de Oliveira Castro, William Jalby, Etienne Renault. 3-23 [doi]
- Scalable Code Generation for RTL Simulation of Deep Learning Accelerators With MLIRJie Tong, Wan-Luan Lee, Umit Yusuf Ogras, Tsung-Wei Huang. 24-37 [doi]
- Scheduling Task and Data Parallelism in Array Languages with Work AssistingIvo Gabe de Wolff, David P. van Balen, Gabriele K. Keller. 38-52 [doi]
- THAPI: Tracing Heterogeneous APIsSolomon Bekele, Aurelio Vivas, Thomas Applencourt, Servesh Muralidharan, Bryce Allen, Kazutomo Yoshii, Swann Perarnau, Brice Videau. 54-70 [doi]
- Making MPI Collective Operations Visible: Understanding Their Utility and Algorithmic InsightsAnna-Lena Roth, David James, Michael Kuhn 0003, Dustin Frisch. 71-84 [doi]
- TSim4CXL: Trace-Driven Simulation Framework for CXL-Based High-Performance Computing SystemsJaewoo Son, Youngchul Yoon, Soonhoi Ha. 85-99 [doi]
- Polymorphic Higher-Order GPU KernelsAndré Rauber Du Bois, Gerson G. H. Cavalheiro. 100-113 [doi]
- FusionWei Li, Ao Ren, Qingqiu Lan, Haining Fang, Zhenyu Wang, Yujuan Tan, Kan Zhong, Duo Liu. 114-128 [doi]
- Approximation Bounds for SLACK on Identical Parallel MachinesLouis-Claude Canon, Anthony Dugois, Pierre-Cyrille Héam, Ismaël Jecker. 131-144 [doi]
- Leveraging Expert Usage to Speed up LLM Inference with Expert ParallelismOlivier Beaumont, Raphaël Bourgouin, Maxime Darrin, Loris Marchal, Pablo Piantanida. 145-158 [doi]
- HAS-GPU: Efficient Hybrid Auto-scaling with Fine-Grained GPU Allocation for SLO-Aware Serverless InferencesJianfeng Gu, Puxuan Wang, Isaac David Núñez Araya, Kai Huang, Michael Gerndt. 159-174 [doi]
- ARC-V: Vertical Resource Adaptivity for HPC Workloads in Containerized EnvironmentsDaniel Medeiros 0002, Jeremy J. Williams, Jacob Wahlgren, Leonardo Saud Maia Leite, Ivy Peng. 175-189 [doi]
- MPLS: Stacking Diverse Layers Into One Model for Decentralized Federated LearningYang Xu 0020, Zhiwei Yao, Hongli Xu, Yunming Liao, Zuan Xie. 190-204 [doi]
- An Autonomy Loop for Dynamic HPC Job Time Limit AdjustmentThomas Jakobsche, Osman Seckin Simsek, Jim M. Brandt, Ann C. Gentile, Florina M. Ciorba. 205-218 [doi]
- Priority-BF: A Task Manager for Priority-Based SchedulingAna Gainaru, Scott Klasky, Guillaume Pallez. 219-232 [doi]
- WAPA: A Workload-Agnostic CPI-Based Thread-to-Core Allocation PolicyMarta Navarro 0001, Vicent Pallardó-Julià, Salvador Petit, María Engracia Gómez, Julio Sahuquillo. 233-247 [doi]
- Auction-Based Placement of Function Chains in the Fog at ScaleVolodia Parol-Guarino, Nikos Parlavantzas. 248-263 [doi]
- Federated Learning Within Global Energy Budget over Heterogeneous Edge AcceleratorsRoopkatha Banerjee, Tejus Chandrashekar, Ananth Eswar, Yogesh Simmhan. 264-278 [doi]
- Bifröst: Peer-to-Peer Load-Balancing for Function Execution in Agentic AI SystemsGiuseppe Coviello, Kunal Rao, Mohammad A. Khojastepour, Srimat Chakradhar. 279-291 [doi]
- DynoInfer: Adaptive Resource Orchestration for LLM Inference on Resource-Constrained PCsYunling Chen, Qingyin Lin, Zhitao Chen, Yang Ou, Zhiguang Chen 0001. 292-306 [doi]
- Enabling Elasticity in Scientific Workflows for High-Performance Computing SystemsRajat Bhattarai, Howard Pritchard, Sheikh K. Ghafoor. 307-321 [doi]
- Container Workload Prediction Using Deep Domain Adaptation in Transfer LearningYunlan Wang, Yutong Liu, Tianhai Zhao, Mingxuan Liu, Jianhua Gu, Zhengxiong Hou, Chengwen Zhong. 322-336 [doi]
- CGP-Graphless: Towards Efficient Serverless Graph Processing via CPU-GPU Pipelined CollaborationYiming Sun, Jiaqi Zhang, Jie Zhang 0130, Huawei Cao, Xuejun An, Xiaochun Ye. 337-350 [doi]
- KarmaPM: Reward-Driven Power ManagerSunil Kumar, Vivek Kumar. 351-365 [doi]
- A Sparsity Predicting Approach for Large Language Models via Activation Pattern ClusteringNobel Dhar, Bobin Deng, Md. Romyull Islam, Xinyue Zhang 0001, Kazi Fahim Ahmad Nasif, Kun Suo. 366-379 [doi]
- Green Scheduling on the EdgeJoachim Cendrier, Rajini Wijayawardana, Anne Benoit, Yves Robert, Frédéric Vivien, Andrew A. Chien. 380-394 [doi]
- Design and Operation of Elastic GPU-Pooling on CampusKaicheng Guo, Jingyi Chen, Yun Wang, Semakin Anton, Tovmachenko Dmitry, Jiajie Sheng, Jianwen Wei, James Lin, Zhengwei Qi, Haibing Guan. 395-409 [doi]
- ServerlessRec: Fast Serverless Inference for Embedding-Based Recommender Systems with Disaggregated MemoryMingxuan Liu, Jianhua Gu, Tianhai Zhao. 410-423 [doi]