1 of 10

Technical Sessions

Friday, December 17, 2021

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

2 of 10

  • Parallel Actors and Learners: A Framework for Generating Scalable RL Implementations
    • Chi Zhang, Sanmukh Kuppannagari, Viktor Prasanna
  • DEISA Dask-Enabled In Situ Analytics
    • Amal Gueroudji, Julien Bigot, Bruno Raffin
  • A Model of Graph Transactional Coverage Patterns with Applications to Drug Discovery
    • A Srinivas Reddy, P Krishna Reddy, Anirban Mondal, Deva Priyakumar
  • Faster Parallel Training of Word Embeddings
    • Eliza Wszola, Martin Jaggi, Markus Pueschel
  • CMAP-LAP: Configurable Massively Parallel Solver for Lattice Problems
    • Nariaki Tateiwa, Yuji Shinano, Keiichiro Yamamura, Akihiro Yoshida, Shizuo Kaji, Masaya Yasuda Katsuki Fujisawa
  • MulConn: User-Transparent I/O Subsystem for High-Performance Parallel File Systems
    • Hwajung Kim, Jiwoo Bang, Dong Kyu Sung, Hyeonsang Eom, Heonyoung Yeom, Hanul Sung

Session Chairs: Fatemeh Vafaee, Shad Kirmani (1:30 pm – 2:05 pm IST | 8:00 – 8:35 am UTC)

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

3 of 10

Technical Session 2: HPC Algorithms

  • Monte Carlo Tree Search for Task Mapping onto Heterogeneous Platforms
    • Ta-Yang Wang, William Chang, Ajitesh Srivastava, Rajgopal Kannan, Viktor Prasanna
  • Shared-memory implementation of the Karp-Sipser kernelization process
    • Johannes Langguth, Ioannis Panagiotas, Bora Ucar
  • How to Avoid Zero-Spacing in Fractionally-Strided Convolution? A Hardware-Algorithm Co-Design Methodology
    • Yuan Meng, Sanmukh Kuppannagari, Rajgopal Kannan, Viktor Prasanna
  • PPBT: A High Performance Parallel Search Tree
    • Jiawen Guan, Rui Fan
  • Deciding Non-Compressible Blocks in Sparse Direct Solvers using Incomplete Factorization
    • Esragul Korkmaz, Mathieu Faverge, Gregoire Pichon, Pierre Ramet

Session Chairs: Qiang Wang, De Sensi Daniele (2:05 pm – 2:40 pm IST | 8:35 – 9:10 am UTC)

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

4 of 10

Technical Session 3: HPC Applications

  • Efficient Parallel Algorithms for Computing Percolation Centrality
    • Kishore Kothapalli, Athreya Chandramouli, Sayantan Jana
  • Accelerating JPEG Decompression on GPUs
    • André Weißenberger, Bertil Schmidt
  • Towards Zero-Waste Recovery and Zero-Overhead Checkpointing in Ensemble Data Assimilation
    • Kai Keller, Adrian Cristal Kestelman, Leonardo Bautista Gomez
  • Predictive Analysis of Large-Scale Coupled CFD Simulations with the CPX Mini-App
    • Archie Powell, Kabir Choudry, Arun Prabhakar, Istvan Reguly, Dario Amirante, Stephen Jarvis, Gihan Mudalige
  • The 16, 384-node Parallelism of 3D-CNN Training on An Arm CPU based Supercomputer
    • Akihiro Tabuch, Koichi Shirahata, Masafumi Yamazaki, Akihiko Kasagi, Takumi Honda, Kouji Kurihara, Kentaro Kawakami, Tsuguchika Tabaru, Naoto Fukumoto, Akiyoshi Kuroda, Takaaki Fukai, Kento Sato

Session Chairs: Sameh M. Abdulah, Sabri Pllana (2:40 pm – 3:12 pm IST | 9:10 - 9:42 am UTC)

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

5 of 10

Technical Session 4: HPC Architecture and System Software

  • iPUG for multiple Graphcore IPUs: Optimizing performance and scalability of parallel breadth-first search
    • Luk Burchard, Xing Cai, Johannes Langguth
  • Empirical Analysis of Architectural Primitives for NVRAM Consistency
    • Arun KP, Debadatta Mishra, Biswabandan Panda
  • JACC: An OpenACC Runtime Framework with Kernel-Level and Multi-GPU Parallelization
    • Kazuaki Matsumura, Simon Garcia De Gonzalo, Antonio J. Peña

Session Chair: K V Subramaniam (3:12 pm – 3:35 pm IST | 9:42 am – 10-05 am UTC)

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

6 of 10

Technical Sessions

Saturday, December 18, 2021

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

7 of 10

Technical Session 5: HPC Algorithms and Architecture

  • Anti-Section Transitive Closure
    • Oded Green, Zhihui Du, Sanyamee Patel, Zehui Xie, Hang Liu, David A. Bader
  • Column-Segmented Sparse Matrix-Matrix Multiplication
    • Xiaojing An, Ümit Çatalyürek
  • Multi-Stage Memory Efficient Strassen’s Matrix Multiplication on GPU
    • Arjun Gopala Krishnan, Dhrubajyoti Goswami
  • Optimizing k-path selection for randomized interconnection networks
    • Md Nahid Newaz, Md Atiqul Mollah
  • Dynamic Voltage and Frequency Scaling to Improve Energy-Efficiency of Hardware Accelerators
    • Siqin Liu, Avinash Karanth

Session Chairs: Raghavendra Kanakagiri, Unnikrishnan C (7:30 am – 8:00 am IST | 2:00 – 2:35 am UTC)

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

8 of 10

Technical Session 6: HPC System Software

  • Adaptive Placement of Data Analysis Tasks For Staging Based In-Situ Processing
    • Zhe Wang, Pradeep Subedi, Matthieu Dorier, Philip E. Davis, Manish Parashar
  • HEALS: A Parallel eALS Recommendation System on CPU/GPU Heterogeneous Platforms
    • Qihan Wang, Bin Ren, Wei Niu, Ruoming Jin, Chen Li
  • Shrinking Sample Search Algorithm for Automatic Tuning of GPU Kernels
    • Xiang Li, Gagan Agrawal
  • Towards Architecture-aware Hierarchical Communication Trees on Modern HPC Systems
    • Bharath Ramesh, Jahanzeb Maqbool Hashmi, Shulei Xu, Aamir Shafi, Mahdieh Ghazimirsaeed, Mohammadreza Bayatpour, Hari Subramoni, Dhabaleswar Panda

Session Chair: Nikhil Hegde (8:00 – 8:35 am IST | 2:30 – 3:05 am UTC)

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

9 of 10

Technical Session 7: Scalable Algorithms and Systems for Data Science – part 2

  • DistMILE: A Distributed Multi-Level Framework for Scalable Graph Embedding
    • Yuntian He, Saket Gurukar, Pouya Kousha, Hari Subramoni, Dhabaleswar K. Panda, Srinivasan Parthasarathy
  • Model-based Reinforcement Learning for Elastic Stream Processing in Edge Computing
    • Jinlai Xu, Balaji Palanisamy
  • Layout Aware Hardware Assisted Design for Derived Data Types in MPI
    • Kaushik Suresh, Bharath Ramesh, Chen Chun Chen, Seyedeh Mahdieh Ghazimirsaeed, Mohammadreza Bayatpour, Aamir Shafi, Hari Subramoni, Dhabaleswar Panda
  • Parallel Algorithms for Efficient Computation of High-Order Line Graphs of Hypergraphs
    • Xu Tony Liu, Jesun Firoz, Andrew Lumsdaine, Cliff Joslyn, Sinan Aksoy, Brenda Praggastis, Assefaw Gebremedhin

Session Chair: Sriram Krishnamoorthy ( 8:35 – 8:57 am IST | 3:05 – 3:27 am UTC )

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021

10 of 10

Technical Session 8: Scalable Algorithms and Systems for Data Science – part 3

  • Asynchronous I/O Strategy for Large-Scale Deep Learning Applications
    • Sunwoo Lee, Qiao Kang, Kewei Wang, Jan Balewski, Alex Sim, Ankit Agrawal, Alok Choudhary, Peter Nugent, Kesheng Wu, Wei-Keng Liao
  • SYMBIOMON: A High Performance, Composable Monitoring Service
    • Srinivasan Ramesh, Robert Ross, Matthieu Dorier, Allen Malony, Philip Carns, Kevin Huck
  • Load-balancing Parallel I/O of Compressed Hierarchical Layouts
    • Sidharth Kumar, Ke Fan, Duong Hoang, Steve Petruzza, Thomas Gilray, Valerio Pascucci,
  • CUDA-DClust+: Revisiting Early GPU-Accelerated DBSCAN Clustering Designs
    • Madhav Poudel, Michael Gowanlock

Session Chair: Satish Puri ( 8:57 – 9:30 am IST | 3:27 – 4:00 am UTC)

28th IEEE Conference On High Performance Computing, Data, and Analytics, Dec 17-18, 2021