Schedule

09:00 PMBS Introduction and Welcome

Sascha Hunold
TU Wien, Austria


Session 1: CPU Architectures – Measuring Today’s Arm CPUs, Designing Tomorrow’s

Chair: TBC

09:15 - 09:35
NVIDIA Vera: A Microarchitecture-Level Comparison with Grace, Turin, and Granite Rapids

Joseph Moore, Thomas Green, Simon McIntosh-Smith
Bristol Centre for Supercomputing, University of Bristol, England


09:35 - 09:55
Automated Design Space Exploration of ARM CMN-Based HPC Architectures: A Case Study for the European Rhea Family Processors

Lilia Zaourar, Mohamed Benazouz
French Alternative Energies and Atomic Energy Commission (CEA), France

Valentin Dubois-Fournet, Eric Mercier
Sipearl


10:00 - 10:30 Break


Session 2: Short Papers

Chair: TBC

10:30 - 10:45
Repository-Scale Performance Characterization of the IO500 Benchmark

Julian Kunkel, Aasish Kumar Sharma, Sepehr Mahmoodianhamedani, Anila Ghazanfar, Sascha Safenreiter
Gesellschaft für wissenschaftliche Datenverarbeitung mbH Göttingen, University of Göttingen, Germany


10:45 - 11:00
Orrery: Modeling and Simulation of GPU-direct MPI Communication with SimGrid

Ahmad Moh’d Saleh A. Belbeisi
Technical University of Munich, Germany

Majid Salimi Beni
Vienna University of Technology, Austria

Amir Raoofy
Leibniz Supercomputing Centre, Germany

Josef Weidendorfer
Technical University Dresden, Germany


11:00 - 11:15
CXDVirt: Low Latency Kernel Module based CXL-SSD Emulation

Hyunsun Chung, Seongho Bong, Youngjae Kim
Sogang University, South Korea

Hong-Yeon Kim
Electronics and Telecommunications Research Institute (ETRI), South Korea


11:15 - 11:30
Matching Workloads to Blackwell: Power-Resolved Benchmarking of NVIDIA B200 and B300 across HPC and AI Workloads

Mohsen Zand, Trung Dac Nguyen, H. Birali Runesha
University of Chicago, IL, United States


Session 3: Accelerators, Precision, and Exascale (Distinguished Papers)

Chair: TBC

11:30 - 11:50
HPL and HPL-MxP at Exascale on Aurora: Performance Engineering and Characterization

Kazushige Goto, Huda Ibeid, Anthony-Trung Nguyen, Aditya Nishtala
Intel Corporation, United States

Kalyan Kumaran, Servesh Muralidharan
Argonne National Laboratory, IL, United States


11:50 - 12:10
Performance comparison and analysis of macroscopic cross section lookup kernel on Cerebras CS-3 and NVIDIA GPUs

Reo Nagashima, Akeru Nakamura, Takaaki Miyajima
Meiji University, Japan

John R. Tramm
Argonne National Laboratory, IL, United States


12:10 - 12:30
FP64 Performance and the Limits of Ozaki Emulation on HPC Systems

Katarzyna (Kasia) Swirydowicz, Nicholas Malaya, Noah Wolfe, Paul Bauman, Pieter Ghysels, Jonathan Belof
Advanced Micro Devices, Inc, United States


12:30 - 14:00 Lunch


Session 4: Sharing and Operating Production Systems

Chair: TBC

14:00 - 14:20
Benchmarking Physical GCD Placement Effects on Performance, Energy, and Co-Execution

Arthur Lorenzon, Philippe Navaux
Federal University of Rio Grande do Sul, Brazil

Antigoni Georgiadou, James White III, Bronson Messer
Oak Ridge National Laboratory, TN, United States

Bruno Alvarez, Jordà Polo, Karl Schulz
AMD, United States


14:20 - 14:40
Enhancing Data Center Efficiency and Throughput by Co-Scheduling

Paul Lin, Nestor Demeure, Mathias Wagner, Francesca Tartaglione, Garima Kochhar
NVIDIA, United States

Jonathan Skone, Dhruva Kulkarni, Jack Deslippe, Brian Austin
Lawrence Berkeley National Laboratory, CA, United States

Ian Karlin
Queen’s University, Canada


14:40 - 15:00
Custodian: Enabling Automatic Performance Engineering Agents on the NERSC HPC System

Abdul Hannan Mohammed, Oscar Antepara, Dhruva Kulkarni, Muaaz Gul Awan, Samuel Williams, Jack Deslippe
Lawrence Berkeley National Laboratory, CA, United States


15:00 - 15:30 Break


Session 5: Performance Modeling and Simulation

Chair: TBC

15:30 - 15:50
PortWarp: A Cycle-Accurate GPU-Accelerated HPC Network Simulator Using Port-per-Thread Model

Jun Tan, Boning Li, Christopher Carothers
Rensselaer Polytechnic Institute, NY, United States

Kevin Brown
Argonne National Laboratory, IL, United States

Zhiling Lan
University of Illinois Chicago, IL, United States


15:50 - 16:10
DMSim: Configurable Data Management Simulation Framework for Scientific Computing Grid

Kuan-Chieh Hsu, Raees Ahmad Khan, Sairam Sri Vatsavai, Tasnuva Chowdhury, Ozgur Kilic, Sankha Dutta, David Park, Yihui Ren, Shinjae Yoo, Alexei Klimentov, Adolfy Hoisie
Brookhaven National Laboratory, NY, United States

Shengyu Feng, Yiming Yang
Carnegie Mellon University, PA, United States

Fatih Furkan Akman
University of Massachusetts Amherst, MA, United States

Rui Xue, John Rembrandt (Remy) Steele, Paul Nilsson, Tadashi Maeno, Verena Ingrid Martinez Outschoorn
European Organization for Nuclear Research (CERN), Switzerland

Tatiana Korchuganova, Joseph Boudreau
University of Pittsburgh, PA, United States

Scott Klasky, Norbert Podhorszki, Frederic Suter
Oak Ridge National Laboratory, TN, United States

Wei Yang, Kenny Yo
SLAC National Accelerator Laboratory, CA, United States


16:10 - 16:30
AMAI: Algebraic Modelling of Distributed AI Computations for Symbolic Performance Analysis

Rubén Coll Sánchez
Huawei Technologies, France
Sorbonne University Paris VI, France

Thibaut Tachon, Pierre Leca, Chong Li
Huawei Technologies, France

Teng Su
Huawei Technologies, China


Session 6: Memory-Bound Performance – Bandwidth, NUMA, and Data Movement

Chair: TBC

16:30 - 16:50
Scalable AMG Preconditioning for DG Neutron Diffusion Solvers on Manycore CPUs

Antoine Kempf, Ansar Calloo, Cédric Chevalier, Marc Perache
French Alternative Energies and Atomic Energy Commission (CEA), France
Université Paris-Saclay, France

Romain Le Tellier
French Alternative Energies and Atomic Energy Commission (CEA), France


16:50 - 17:10
Exploiting the Interplay of Compute- and Memory-Bound kernels in MPI Applications

Ayesha Afzal, Georg Hager
Erlangen National High Performance Computing Center, Friedrich-Alexander-Universität Erlangen-Nürnberg, Germany

Krishna Manda
University of Bonn, Germany


17:10 - 17:30
FHE-STREAM: Characterizing Memory Access Behavior in Fully Homomorphic Encryption Workloads

Ashlesha Malla, Yash Kumar, Michael Beebe, Yong Chen
Texas Tech University, TX, United States

Wendy Poole, Steve Poole
Los Alamos National Laboratory, NM, United States


17:30 PMBS End