运行时优化
面向动态负载,研究大语言模型和扩散模型的 KV 缓存管理、模型压缩与调度。
浙江大学百人计划研究员
主要从事智能计算系统性能优化研究,重点关注智能体服务、生成式人工智能运行时和云边智能。相关成果已在国产智能计算芯片和企业级智能服务中开展落地验证。
Armor 是面向微服务统一故障管理的缺失感知多模态融合系统,已录用至 ASE 2026。
Agentic Services Computing 从服务计算视角提出以自主智能体为中心的系统范式。
Towards Optimal Robustness in Learning-Augmented Paging 获 ICML 2026 Spotlight。
围绕智能服务的部署、协同与运行,研究在线优化、系统和机器学习方法。
面向动态负载,研究大语言模型和扩散模型的 KV 缓存管理、模型压缩与调度。
面向异构云边平台,研究兼顾性能、可靠性和效率的算法与系统。
研究智能体服务平台的运行时支撑、故障管理和资源控制机制。
PFSUM 聚焦经典在线租赁购买问题 Bahncard problem。Guard 和 RPB 则研究预测不完美条件下的鲁棒学习增强缓存与分页算法。
SegQuant 研究语义感知量化,Shiva-DiT 探索高效扩散 Transformer 的可微选择方法。
研究以智能体为中心的服务平台及其微服务故障管理机制。近期工作包括 Agentic Services Computing 和 Armor。
ARMOR: Missing-Aware Multimodal Fusion for Unified Microservice Incident Management
Wenzhuo Qian, Hailiang Zhao*, Ziqi Wang, Zhipeng Gao, Jiayi Chen, Zhiwei Ling, and Shuiguang Deng*.
Towards Optimal Robustness in Learning-Augmented Paging
Peng Chen, Hailiang Zhao*, Xueyan Tang, Yixuan Wang, and Shuiguang Deng*.
SegQuant: A Semantics-Aware and Generalizable Quantization Framework for Diffusion Models
Jiaji Zhang, Ruichao Sun, Hailiang Zhao*, Jiaju Wu, Peng Chen, Hao Li, Yuying Liu, Kingsum Chow, Gang Xiong, and Shuiguang Deng*. 项目主页 ↗
PeerSync: Accelerating Containerized Model Inference at the Network Edge
Yinuo Deng†, Hailiang Zhao†*, Dongjing Wang, Peng Chen, Wenzhuo Qian, Jianwei Yin, Schahram Dustdar, and Shuiguang Deng*.
Robustifying Learning-Augmented Caching Efficiently without Compromising 1-Consistency
Peng Chen, Hailiang Zhao*, Jiaji Zhang, Xueyan Tang, Yixuan Wang, and Shuiguang Deng*. 海报 ↗
CADRef: Robust Out-of-Distribution Detection via Class-Aware Decoupled Relative Feature Leveraging
Zhiwei Ling, Yachen Chang, Hailiang Zhao*, Xinkui Zhao, Kingsum Chow*, and Shuiguang Deng. 代码 ↗
Learning-Augmented Algorithms for the Bahncard Problem
Hailiang Zhao, Xueyan Tang*, Peng Chen, and Shuiguang Deng. 代码 ↗ · 讲义 ↗
Online Workload Scheduling for Social Welfare Maximization in the Computing Continuum
Hailiang Zhao, Ziqi Wang, Guanjie Cheng*, Wenzhuo Qian, Peng Chen, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya.
CATScaler: A Convolution-Augmented Transformer Scaling Framework for Cloud-Native Applications
Fan'an Meng, Hongjun Dai*, Guoqing Cong, Bo Zhu, and Hailiang Zhao.
Tail-Learning: Adaptive Learning Method for Mitigating Tail Latency in Autonomous Edge Systems
Cheng Zhang, Yinuo Deng, Hailiang Zhao*, Tianlv Chen, and Shuiguang Deng*.
Cloud-Native Computing: A Survey from the Perspective of Services
Shuiguang Deng*, Hailiang Zhao*, Bingbing Huang, Cheng Zhang, Feiyi Chen, Yinuo Deng, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya. Cover Paper
Scheduling Multi-Server Jobs with Sublinear Regrets via Online Learning
Hailiang Zhao, Xueyan Tang*, Peng Chen, Jianwei Yin, and Shuiguang Deng.
Learning to Schedule Multi-Server Jobs with Fluctuated Processing Speeds
Hailiang Zhao, Shuiguang Deng*, Zhengzhe Xiang, Xueqiang Yan, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya.
Dependent Function Embedding for Distributed Serverless Edge Computing
Shuiguang Deng, Hailiang Zhao, Zhengzhe Xiang, Cheng Zhang, Rong Jiang, Ying Li*, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya.
DPoS: Decentralized, Privacy-Preserving, and Low-Complexity Online Slicing for Multi-Tenant Networks
Hailiang Zhao, Shuiguang Deng*, Zijie Liu, Zhengzhe Xiang, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya. Trending Paper
Distributed Redundant Placement for Microservice-based Applications at the Edge
Hailiang Zhao, Shuiguang Deng*, Zijie Liu, Zhengzhe Xiang, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya. ESI Highly Cited Paper
Edge Intelligence: The Confluence of Edge Computing and Artificial Intelligence
Shuiguang Deng, Hailiang Zhao, Weijia Fang*, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya. ESI Hot & Highly Cited Paper
A Mobility-aware Cross-edge Computation Offloading Framework for Partitionable Applications
Hailiang Zhao, Shuiguang Deng*, Cheng Zhang, Wei Du, Qiang He, and Jianwei Yin. Best Student Paper
Shuiguang Deng*, Hailiang Zhao*, Ziqi Wang, Guanjie Cheng, Peng Chen, Wenzhuo Qian, Zhiwei Ling, Jianwei Yin, Albert Y. Zomaya, and Schahram Dustdar.
Shiva-DiT: Residual-Based Differentiable Top-k Selection for Efficient Diffusion Transformers
Jiaji Zhang, Hailiang Zhao*, Guoxuan Zhu, Ruichao Sun, Jiaju Wu, Xinkui Zhao, Hanlin Tang, Weiyi Lu, Kan Liu, Tao Lan, Lin Qu, and Shuiguang Deng*.
Morphis: SLO-Aware Resource Scheduling for Microservices with Time-Varying Call Graphs
Yu Tang†, Hailiang Zhao†*, Chuansheng Lu, Yifei Zhang, Kingsum Chow*, Shuiguang Deng, and Rui Shi.
Hailiang Zhao, Ziqi Wang, Daojiang Hu, Zhiwei Ling, Wenzhuo Qian, Jiahui Zhai, Yuhao Yang, Zhipeng Gao, Mingyi Liu, Kai Di, Xinkui Zhao, Zhongjie Wang, Jianwei Yin, MengChu Zhou, and Shuiguang Deng.
OmniFuser: Adaptive Multimodal Fusion for Service-Oriented Predictive Maintenance
Ziqi Wang, Hailiang Zhao*, Yuhao Yang, Daojiang Hu, Cheng Bao, Mingyi Liu, Kai Di, Schahram Dustdar, Zhongjie Wang, and Shuiguang Deng.
Toward Robust and Efficient ML-Based GPU Caching for Modern Inference
Peng Chen, Jiaji Zhang, Hailiang Zhao*, Yirong Zhang, Jiahong Yu, Xueyan Tang, Yixuan Wang, Hao Li, Jianping Zou, Gang Xiong, Kingsum Chow, Shuibing He, and Shuiguang Deng*.
担任《计算机工程与科学》青年编委,以及 NeurIPS、IJCAI-ECAI、AAAI、PAKDD 等会议审稿人;担任 IEEE TSC、TMC、FGCS、TKDD、IoTJ 等期刊审稿人。
面向课程学习和科研交流的讲义、方法说明与系统分析资料。