Hairui Zhao (赵海睿)
Assistant Professor / Postdoc
Institute of Computing Technology, Chinese Academy of Sciences
zhaohairui[at]ict[dot]ac[dot]cn



Hairui Zhao (Harry) is currently an Assistant Professor/Postdoc (特别研究助理) at the High Performance Computer Research Center (led by Prof. Guangmin Tan), Institute of Computing Technology, Chinese Academy of Sciences (ICT, CAS). He is currently a member of the Data Infrastructure Software Group, led by Prof. Dingwen Tao. He received my Ph.D. from the College of Computer Science and Technology at Jilin University (JLU), supervised by Associate Prof. Hongliang Li. From September 2024, I was a Joint Ph.D. Student at the University of California, Riverside (UCR), supported by the China Scholarship Council (CSC) and supervised by Prof. Zizhong Chen. My research interests include: Distributed Systems, Fault-Tolerant, High-Performance Computing (HPC), and Scheduling.

🎓 Experience

  • 2026.04 - Present, ICT, CAS, Beijing, China, Assistant Professor (Postdoc)
  • 2025.11 - 2026.04, ICT, CAS, Beijing, China, Intern
  • 2024.09 - 2025.10, UCR, California, USA, Joint Ph.D.
  • 2021.09 - 2026.03, JLU, Changchun, China, Ph.D.
  • 2019.12 - 2020.02, ICT, CAS, Beijing, China, Intern
  • 2019.09 - 2021.06, JLU, Changchun, China, M.S.
  • 2015.09 - 2019.06, JLU, Changchun, China, B.S.

📰 News

  • 🎉Sep 2026: Our paper “Parallel DNN Training with Uniform Local Batch in Heterogeneous Environments” was accepted by IEEE TPDS 2026 (CCF-A). Congratulations to Qi Tian!
  • 🎉Aug 2026: Our paper “Low-Latency DNN Model Exploration via Opportunistic Resource Sharing” was accepted by IEEE TPDS 2026 (CCF-A).
  • 🎉Jul 2026: Our paper “Tools-CC-Bench: A Benchmark Suite for Collective Communication with Compression in HPC and AI Workloads” was accepted by IEEE IISWC 2026 (CCF-B).
  • 🎉Jul 2026: Our paper “Evaluation and Optimization of Communication Compression for 10K-GPU LLM Training” was accepted by IEEE SC 2026 (CCF-A). Congratulations to Xingchen!
  • 🎉May 2026: Our paper “KVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM Serving” was accepted by ACM SIGCOMM 2026 (CCF-A). Congratulations to Zedong!
  • 🎉Apr 2026: Our paper “Sift: Channel-Wise Historical Embedding for High Efficiency Distributed Graph Neural Network Training with Accuracy Guarantee” was published in ACM Transactions on Architecture and Code Optimization (TACO, CCF-A).
  • 🎉Apr 2026: Two papers accepted by HPDC 2026 (CCF-A):
    • “TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training.”
    • “cuNNQS-SCI: A Fully GPU-Accelerated Framework for High-Performance Configuration Interaction Selection with Neural Network Quantum States.”
  • 🎉Mar 2026: Our paper “ENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs” was accepted by ISCA 2026 (CCF-A).
  • 🎉Dec 2025: Our paper “Rehabilitating over Recomputing: A Novel Failure Recovery Method for Large Model Training” was accepted by IEEE INFOCOM 2026 (CCF-A).
  • 🎉Nov 2025: Three papers published in PPoPP 2025 (CCF-A):
    • “COCCL: A Collective Communication Library Supporting Easy Integration and Configuration of Customized Compression for Scalable LLM Training.”
    • “CCL-D: A High-Precision Diagnostic System for Slow and Hang Anomalies in Large-Scale Model Training.” (Best Paper Nominee)
    • “PRISM: An Efficient GPU-Based Lossy Compression Framework for Progressive Data Retrieval with Multi-Level Interpolation.” (Best Paper Nominee)
More Details
  • 🎉 Apr 2025: Our paper "FlexPipe: Maximizing the Training Efficiency for Transformer-based models with Variable-Length Inputs" was accepted by USENIX ATC 2025 (CCF-A).
  • 🎉 Feb 2025: Our paper "Alleviating Straggler Impacts for Data Parallel Deep Learning with Hybrid Parameter Update" was accepted by Future Generation Computing Systems (FGCS, CAS Tier 1 TOP). Congratulations to my collaborator, Qi Tian (2023 Master student)!
  • 🎉 Dec 2024: Our paper "ArrayPipe: Introducing Job-Array Pipeline Parallelism for High Throughput Model Exploration" was accepted by IEEE INFOCOM 2025 (CCF-A).
  • 🎉 Nov 2024: Interviewed by the School of Engineering, Westlake University, regarding our NLPCC 2024 Best Paper Award. [Link]
  • 🎉 Nov 2024: Our paper "Visage: Visual-Aware Generation of Adversarial Examples in Black-Box for Text Classification" won the Best Paper Award (1/160) at NLPCC 2024 (CCF-C).

📝 Selected Publications

{*} denotes corresponding author; {^} denotes equal contribution

Qi Tian, Hongliang Li*, Hairui Zhao*, Zichen Wang, Xingchen Liu, Zhewen Xu, Junmin Xiao, Guangming Tan, Dingwen Tao. Parallel DNN Training with Uniform Local Batch in Heterogeneous Environments. IEEE TPDS 2026. (CCF-A)

Hairui Zhao, Hongliang Li*, Qi Tian, Haixiao Xu, Zizhong Chen, Guangming Tan, Dingwen Tao. Low-Latency DNN Model Exploration via Opportunistic Resource Sharing. TPDS 2026. (CCF-A)

Xingchen Liu, Daran Sun, Xingjian Tian, Man Liu, Haoran Kong, Zheng Wei, Hairui Zhao*, Guangming Tan, Dingwen Tao*. Evaluation and Optimization of Communication Compression for 10K-GPU LLM Training. SC 2026. (CCF-A)

Hairui Zhao^, Qi Tian^, Hongliang Li*, Zizhong Chen. FlexPipe: Maximizing Training Efficiency for Transformer-based Models with Variable-Length Inputs. ATC 2025. (CCF-A)

Hairui Zhao, Hongliang Li*, Qi Tian, Jie Wu, Meng Zhang, Zhewen Xu, Xiang Li, Haixiao Xu. ArrayPipe: Introducing Job-Array Pipeline Parallelism for High Throughput Model Exploration. INFOCOM 2025. (CCF-A)

Hairui Zhao^, Xinyu Li^, Hongliang Li*. Visage: Visual-Aware Generation of Adversarial Examples in Black-Box for Text Classification. NLPCC 2024. (Best Paper Award🏆 CCF-C)

Bing Lu^, Zedong Liu^, Hairui Zhao, Dejun Luo, Wenjing Huang, Yida Gu, Jinyang Liu, Guangming Tan, Dingwen Tao*. PRISM: An Efficient GPU-Based Lossy Compression Framework for Progressive Data Retrieval with Multi-Level Interpolation. PPoPP 2026. (Best Paper Nominee🏆, CCF-A)

Yida Gu^, Fakang Wang^, Jianhao Fu, Zhenhang Sun, Qianyu Zhang, Hairui Zhao, Xingchen Liu, Yang Tian, Wenjing Huang, Zedong Liu, Yifan Chen, Jinwu Yang, Yueyuan Zhou, Qian Zhao, Haoxu Li, Tao Wang*, Feng Yu, Zhan Wang, Guangming Tan, Dingwen Tao*. CCL-D: A High-Precision Diagnostic System for Slow and Hang Anomalies in Large-Scale Model Training. PPoPP 2026. (Best Paper Nominee🏆, CCF-A)

Zedong Liu, Xinyang Ma, Dejun Luo, Hairui Zhao, Bing Lu, Wenjing Huang, Yida Gu, Xingchen Liu, Zheng Wei, Jinyang Liu, Dingwen Tao*, Guangming Tan*. KVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM Serving. SIGCOMM 2026. (CCF-A)

Hongliang Li, Hairui Zhao, Ting Sun, Xiang Li*, Haixiao Xu, Keqin Li. Interference-aware Opportunistic Job Placement for Shared Distributed Deep Learning Clusters. JPDC 2024. (CCF-B)

Hongliang Li, Hairui Zhao, Zhewen Xu, Xiang Li*, Haixiao Xu. ExplSched: Maximizing Deep Learning Cluster Efficiency for Exploratory Jobs. CLUSTER 2023. (CCF-B)

XingChen Liu^, Haoran Kong^, Hairui Zhao, Shengkai Lyu, Zheng Wei, Man Liu, Xingjian Tian, Liyang Zhao, Zizhong Chen, Dingwen Tao*. COCCL: A Collective Communication Library Supporting Easy Integration and Configuration of Customized Compression for Scalable LLM Training. PPoPP 2026. (CCF-A)

Zichen Wang, Hongliang Li*, Jie Wu, Zhewen Xu, Hairui Zhao, Qi Tian, Haixiao Xu. Rehabilitating over Recomputing: A Novel Failure Recovery Method for Large Model Training. INFOCOM 2026. (CCF-A)

Zhewen Xu, Hongliang Li*, Junze Han, Hengshan Yue, Hairui Zhao, Dongyuan Tian, Zijian Li, Xiaohui Wei*. Sift: Channel-Wise Historical Embedding for High Efficiency Distributed Graph Neural Network Training with Accuracy Guarantee. TACO 2026. (CCF-A)

Daran Sun^, Bowen Kan^, Haoquan Long^, Hairui Zhao, Haoxu Li, Yicheng Liu, Pengyu Zhou, Ankang Feng, Wenjing Huang, Yida Gu, Zhenyu Li, Honghui Shang*, Yunquan Zhang, Dingwen Tao, Ninghui Sun, Guangming Tan*. A Fully GPU-Accelerated Framework for High-Performance Configuration Interaction Selection with Neural Network Quantum States. HPDC 2026. (CCF-A)

Man Liu, Xingchen Liu, Xingjian Tian, Bing Lu, Shengkay Lyu, Shengquan Yin, Wenjing Huang, Zheng Wei, Hairui Zhao, Guangming Tan, Dingwen Tao*. TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training. HPDC 2026. (CCF-A)

Jinwu Yang, Jiaan Wu, Zedong Liu, Xinyang Ma, Hairui Zhao, Yida Gu, Yuanhong Huang, Xingchen Liu, Wenjing Huang, Zheng Wei, Jing Xing, Yili Ma, Qingyi Zhang, Baoyi An, Zhongzhe Hu, Shaoteng Liu, Xia Zhu, Jiaxun Lu, Guangming Tan, Dingwen Tao*. ENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs. ISCA 2026. (CCF-A)

🏅 Honors and Awards

🏆 Featured Award

  • Best Paper Nominee, (PPoPP 2026)
  • Best Paper Award (1/160), (NLPCC 2024)

🏆 National & International

  • CSC Scholarship (China Scholarship Council): (2024–2026)
  • National Encouragement Scholarship (2017–2018)

🏆 University & Specialized

  • Zhengyuan Scholarship, Jilin University (2023–2024)
  • Wang Xianghao Scholarship Jilin University (2022–2023)
  • Outstanding Graduate Student Scholarship (Second Prize) (2022–2023)
  • Doctoral Academic Fellowship/Scholarship, Jilin University (2021–2024)
  • Master’s Academic Fellowship/Scholarship, Jilin University (2020–2021)

🏆 Leadership & Service

  • Outstanding Graduate Student Leader (2022–2023)
  • Outstanding Youth League Leader, (2021)
  • Outstanding Graduate Student Leader (2020)
  • Outstanding Class Officer (2018–2019)
- 2017-2018学年国家励志奖学金 - 2018-2019优秀班级干部 - 2018年吉林大学夏令营优秀营员 - 2021年软件与理论硕士研究生优秀团干部 - 2020-2021学年研究生学业奖学金获奖 - 2020年优秀研究生干部 - 2021-2024学年博士研究生学业奖学金获奖 - 2022-2023 年研究生优秀奖学金 (二等) - 2022-2023 年优秀研究生干部 - 2022-2023 年王湘浩奖学金 - 2023-2024年吉林大学正元奖学金 - 2024-2026年2年中国国家留学基金委访问学者项目