Schedule
09:00 PMBS Introduction and Welcome
Sascha Hunold
TU Wien, Austria
Session 1: CPU Architectures – Measuring Today’s Arm CPUs, Designing Tomorrow’s
Chair: TBC
09:15 - 09:35
NVIDIA Vera: A Microarchitecture-Level Comparison with Grace, Turin, and Granite Rapids
Joseph Moore, Thomas Green, Simon McIntosh-Smith
Bristol Centre for Supercomputing, University of Bristol, England
09:35 - 09:55
Automated Design Space Exploration of ARM CMN-Based HPC Architectures: A Case Study for the European Rhea Family Processors
Lilia Zaourar, Mohamed Benazouz
French Alternative Energies and Atomic Energy Commission (CEA), France
Valentin Dubois-Fournet, Eric Mercier
Sipearl
10:00 - 10:30 Break
Session 2: Short Papers
Chair: TBC
10:30 - 10:45
Repository-Scale Performance Characterization of the IO500 Benchmark
Julian Kunkel, Aasish Kumar Sharma, Sepehr Mahmoodianhamedani, Anila Ghazanfar, Sascha Safenreiter
Gesellschaft für wissenschaftliche Datenverarbeitung mbH Göttingen, University of Göttingen, Germany
10:45 - 11:00
Orrery: Modeling and Simulation of GPU-direct MPI Communication with SimGrid
Ahmad Moh’d Saleh A. Belbeisi
Technical University of Munich, Germany
Majid Salimi Beni
Vienna University of Technology, Austria
Amir Raoofy
Leibniz Supercomputing Centre, Germany
Josef Weidendorfer
Technical University Dresden, Germany
11:00 - 11:15
CXDVirt: Low Latency Kernel Module based CXL-SSD Emulation
Hyunsun Chung, Seongho Bong, Youngjae Kim
Sogang University, South Korea
Hong-Yeon Kim
Electronics and Telecommunications Research Institute (ETRI), South Korea
11:15 - 11:30
Matching Workloads to Blackwell: Power-Resolved Benchmarking of NVIDIA B200 and B300 across HPC and AI Workloads
Mohsen Zand, Trung Dac Nguyen, H. Birali Runesha
University of Chicago, IL, United States
Session 3: Accelerators, Precision, and Exascale (Distinguished Papers)
Chair: TBC
11:30 - 11:50
HPL and HPL-MxP at Exascale on Aurora: Performance Engineering and Characterization
Kazushige Goto, Huda Ibeid, Anthony-Trung Nguyen, Aditya Nishtala
Intel Corporation, United States
Kalyan Kumaran, Servesh Muralidharan
Argonne National Laboratory, IL, United States
11:50 - 12:10
Performance comparison and analysis of macroscopic cross section lookup kernel on Cerebras CS-3 and NVIDIA GPUs
Reo Nagashima, Akeru Nakamura, Takaaki Miyajima
Meiji University, Japan
John R. Tramm
Argonne National Laboratory, IL, United States
12:10 - 12:30
FP64 Performance and the Limits of Ozaki Emulation on HPC Systems
Katarzyna (Kasia) Swirydowicz, Nicholas Malaya, Noah Wolfe, Paul Bauman, Pieter Ghysels, Jonathan Belof
Advanced Micro Devices, Inc, United States
12:30 - 14:00 Lunch
Session 4: Sharing and Operating Production Systems
Chair: TBC
14:00 - 14:20
Benchmarking Physical GCD Placement Effects on Performance, Energy, and Co-Execution
Arthur Lorenzon, Philippe Navaux
Federal University of Rio Grande do Sul, Brazil
Antigoni Georgiadou, James White III, Bronson Messer
Oak Ridge National Laboratory, TN, United States
Bruno Alvarez, Jordà Polo, Karl Schulz
AMD, United States
14:20 - 14:40
Enhancing Data Center Efficiency and Throughput by Co-Scheduling
Paul Lin, Nestor Demeure, Mathias Wagner, Francesca Tartaglione, Garima Kochhar
NVIDIA, United States
Jonathan Skone, Dhruva Kulkarni, Jack Deslippe, Brian Austin
Lawrence Berkeley National Laboratory, CA, United States
Ian Karlin
Queen’s University, Canada
14:40 - 15:00
Custodian: Enabling Automatic Performance Engineering Agents on the NERSC HPC System
Abdul Hannan Mohammed, Oscar Antepara, Dhruva Kulkarni, Muaaz Gul Awan, Samuel Williams, Jack Deslippe
Lawrence Berkeley National Laboratory, CA, United States
15:00 - 15:30 Break
Session 5: Performance Modeling and Simulation
Chair: TBC
15:30 - 15:50
PortWarp: A Cycle-Accurate GPU-Accelerated HPC Network Simulator Using Port-per-Thread Model
Jun Tan, Boning Li, Christopher Carothers
Rensselaer Polytechnic Institute, NY, United States
Kevin Brown
Argonne National Laboratory, IL, United States
Zhiling Lan
University of Illinois Chicago, IL, United States
15:50 - 16:10
DMSim: Configurable Data Management Simulation Framework for Scientific Computing Grid
Kuan-Chieh Hsu, Raees Ahmad Khan, Sairam Sri Vatsavai, Tasnuva Chowdhury, Ozgur Kilic, Sankha Dutta, David Park, Yihui Ren, Shinjae Yoo, Alexei Klimentov, Adolfy Hoisie
Brookhaven National Laboratory, NY, United States
Shengyu Feng, Yiming Yang
Carnegie Mellon University, PA, United States
Fatih Furkan Akman
University of Massachusetts Amherst, MA, United States
Rui Xue, John Rembrandt (Remy) Steele, Paul Nilsson, Tadashi Maeno, Verena Ingrid Martinez Outschoorn
European Organization for Nuclear Research (CERN), Switzerland
Tatiana Korchuganova, Joseph Boudreau
University of Pittsburgh, PA, United States
Scott Klasky, Norbert Podhorszki, Frederic Suter
Oak Ridge National Laboratory, TN, United States
Wei Yang, Kenny Yo
SLAC National Accelerator Laboratory, CA, United States
16:10 - 16:30
AMAI: Algebraic Modelling of Distributed AI Computations for Symbolic Performance Analysis
Rubén Coll Sánchez
Huawei Technologies, France
Sorbonne University Paris VI, France
Thibaut Tachon, Pierre Leca, Chong Li
Huawei Technologies, France
Teng Su
Huawei Technologies, China
Session 6: Memory-Bound Performance – Bandwidth, NUMA, and Data Movement
Chair: TBC
16:30 - 16:50
Scalable AMG Preconditioning for DG Neutron Diffusion Solvers on Manycore CPUs
Antoine Kempf, Ansar Calloo, Cédric Chevalier, Marc Perache
French Alternative Energies and Atomic Energy Commission (CEA), France
Université Paris-Saclay, France
Romain Le Tellier
French Alternative Energies and Atomic Energy Commission (CEA), France
16:50 - 17:10
Exploiting the Interplay of Compute- and Memory-Bound kernels in MPI Applications
Ayesha Afzal, Georg Hager
Erlangen National High Performance Computing Center, Friedrich-Alexander-Universität Erlangen-Nürnberg, Germany
Krishna Manda
University of Bonn, Germany
17:10 - 17:30
FHE-STREAM: Characterizing Memory Access Behavior in Fully Homomorphic Encryption Workloads
Ashlesha Malla, Yash Kumar, Michael Beebe, Yong Chen
Texas Tech University, TX, United States
Wendy Poole, Steve Poole
Los Alamos National Laboratory, NM, United States
17:30 PMBS End
