运行时优化
面向动态负载,研究大语言模型和扩散模型的 KV 缓存管理、模型压缩与调度。
浙江大学百人计划研究员
主要从事智能计算系统性能优化研究,重点关注智能体服务、生成式人工智能运行时和云边智能。相关成果已在国产智能计算芯片和企业级智能服务中开展落地验证。
Learning-Augmented Algorithms: Guarantees, Construction Mechanisms, and System-Level Implications 发布于 arXiv。
ARMOR 面向观测模态缺失条件下的微服务根因分析,已录用至 ASE 2026。
Agentic Services Computing 从服务计算视角提出以自主智能体为中心的系统范式。
Towards Optimal Robustness in Learning-Augmented Paging 获 ICML 2026 Spotlight。
围绕智能服务的部署、协同与运行,研究在线优化、系统和机器学习方法。
面向动态负载,研究大语言模型和扩散模型的 KV 缓存管理、模型压缩与调度。
面向异构云边平台,研究兼顾性能、可靠性和效率的算法与系统。
研究智能体服务平台的运行时支撑、故障管理和资源控制机制。
最新综述系统梳理理论保证、构造机制与系统层含义。PFSUM、Guard 和 RPB 分别研究在线租赁购买、缓存和分页问题中的学习增强算法。
SegQuant 研究语义感知量化,Shiva-DiT 探索高效扩散 Transformer 的可微选择方法。
研究以智能体为中心的服务平台及其微服务故障管理机制。近期工作包括 Agentic Services Computing 和 Armor。
Wenzhuo Qian, Hailiang Zhao*, Ziqi Wang, Zhipeng Gao, Jiayi Chen, Zhiwei Ling, and Shuiguang Deng*. 解读
Towards Optimal Robustness in Learning-Augmented Paging
Peng Chen, Hailiang Zhao*, Xueyan Tang, Yixuan Wang, and Shuiguang Deng*. 解读
SegQuant: A Semantics-Aware and Generalizable Quantization Framework for Diffusion Models
Jiaji Zhang, Ruichao Sun, Hailiang Zhao*, Jiaju Wu, Peng Chen, Hao Li, Yuying Liu, Kingsum Chow, Gang Xiong, and Shuiguang Deng*. 项目主页 ↗解读
PeerSync: Accelerating Containerized Model Inference at the Network Edge
Yinuo Deng†, Hailiang Zhao†*, Dongjing Wang, Peng Chen, Wenzhuo Qian, Jianwei Yin, Schahram Dustdar, and Shuiguang Deng*.
Robustifying Learning-Augmented Caching Efficiently without Compromising 1-Consistency
Peng Chen, Hailiang Zhao*, Jiaji Zhang, Xueyan Tang, Yixuan Wang, and Shuiguang Deng*. 海报 ↗
CADRef: Robust Out-of-Distribution Detection via Class-Aware Decoupled Relative Feature Leveraging
Zhiwei Ling, Yachen Chang, Hailiang Zhao*, Xinkui Zhao, Kingsum Chow*, and Shuiguang Deng. 代码 ↗
Learning-Augmented Algorithms for the Bahncard Problem
Hailiang Zhao, Xueyan Tang*, Peng Chen, and Shuiguang Deng. 代码 ↗ · 讲义 ↗
Online Workload Scheduling for Social Welfare Maximization in the Computing Continuum
Hailiang Zhao, Ziqi Wang, Guanjie Cheng*, Wenzhuo Qian, Peng Chen, Jianwei Yin, Schahram Dustdar, and Shuiguang Deng*.
CATScaler: A Convolution-Augmented Transformer Scaling Framework for Cloud-Native Applications
Fan'an Meng, Hongjun Dai*, Guoqing Cong, Bo Zhu, and Hailiang Zhao.
Tail-Learning: Adaptive Learning Method for Mitigating Tail Latency in Autonomous Edge Systems
Cheng Zhang, Yinuo Deng, Hailiang Zhao*, Tianlv Chen, and Shuiguang Deng*.
Cloud-Native Computing: A Survey From the Perspective of Services
Shuiguang Deng*, Hailiang Zhao*, Bingbing Huang, Cheng Zhang, Feiyi Chen, Yinuo Deng, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya. Cover Paper
Scheduling Multi-Server Jobs with Sublinear Regrets via Online Learning
Hailiang Zhao, Shuiguang Deng*, Zhengzhe Xiang, Xueqiang Yan, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya.
Learning to Schedule Multi-Server Jobs with Fluctuated Processing Speeds
Hailiang Zhao, Shuiguang Deng*, Feiyi Chen, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya.
Dependent Function Embedding for Distributed Serverless Edge Computing
Shuiguang Deng, Hailiang Zhao, Zhengzhe Xiang, Cheng Zhang, Rong Jiang, Ying Li*, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya.
DPoS: Decentralized, Privacy-Preserving, and Low-Complexity Online Slicing for Multi-Tenant Networks
Hailiang Zhao, Shuiguang Deng*, Zijie Liu, Zhengzhe Xiang, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya. Trending Paper
Distributed Redundant Placement for Microservice-based Applications at the Edge
Hailiang Zhao, Shuiguang Deng*, Zijie Liu, Jianwei Yin, and Schahram Dustdar. ESI Highly Cited Paper
Edge Intelligence: The Confluence of Edge Computing and Artificial Intelligence
Shuiguang Deng, Hailiang Zhao, Weijia Fang*, Jianwei Yin, Schahram Dustdar, and Albert Y. Zomaya. ESI Hot & Highly Cited Paper
A Mobility-aware Cross-edge Computation Offloading Framework for Partitionable Applications
Hailiang Zhao, Shuiguang Deng*, Cheng Zhang, Wei Du, Qiang He, and Jianwei Yin. Best Student Paper
Learning-Augmented Algorithms: Guarantees, Construction Mechanisms, and System-Level Implications
Hailiang Zhao, Xueyan Tang, Peng Chen, Zenong Ye, Tianjun Zhu, Jianwei Yin, and Shuiguang Deng. 论文解读
Prediction-Robust Service Deployment with Capacity-Aware Edge Admission
Hailiang Zhao, Ziqi Wang, Yifei Zhang, Mingyi Liu, Xinkui Zhao, Kingsum Chow, and Shuiguang Deng.
Shuiguang Deng*, Hailiang Zhao*, Ziqi Wang, Wenzhuo Qian, Xiang Ao, Guanjie Cheng, Jianwei Yin, Albert Y. Zomaya, and Schahram Dustdar.
Shiva-DiT: Residual-Based Differentiable Top-k Selection for Efficient Diffusion Transformers
Jiaji Zhang, Hailiang Zhao*, Jiaju Wu, Ruichao Sun, Xinkui Zhao, and Shuiguang Deng*.
Adaptive Dual-Weighting Framework for Federated Learning via Out-of-Distribution Detection
Zhiwei Ling, Hailiang Zhao*, Chao Zhang, Xiang Ao, Ziqi Wang, Cheng Zhang, Zhen Qin, Xinkui Zhao, Kingsum Chow*, Yuanqing Wu, and MengChu Zhou.
Morphis: SLO-Aware Resource Scheduling for Microservices with Time-Varying Call Graphs
Yu Tang†, Hailiang Zhao†*, Chuansheng Lu, Yifei Zhang, Kingsum Chow*, Shuiguang Deng, and Rui Shi.
Industrial Data-Service-Knowledge Governance: Toward Integrated and Trusted Intelligence
Hailiang Zhao, Ziqi Wang, Daojiang Hu, Mingyi Liu, Jiahui Zhai, Kai Di, Xinkui Zhao, Zhongjie Wang, Jianwei Yin, Albert Y. Zomaya, MengChu Zhou, and Shuiguang Deng.
TrackTeller: Temporal Multimodal 3D Grounding for Behavior-Dependent Object References
Jiahong Yu†, Ziqi Wang†, Hailiang Zhao*, Wei Zhai, Xueqiang Yan, and Shuiguang Deng.
OmniFuser: Adaptive Multimodal Fusion for Service-Oriented Predictive Maintenance
Ziqi Wang, Hailiang Zhao*, Yuhao Yang, Daojiang Hu, Cheng Bao, Mingyi Liu, Kai Di, Schahram Dustdar, Zhongjie Wang, and Shuiguang Deng.
Toward Robust and Efficient ML-Based GPU Caching for Modern Inference
Peng Chen, Jiaji Zhang, Hailiang Zhao*, Yirong Zhang, Shenyao Chen, Jiahong Yu, Xueyan Tang, Yixuan Wang, Hao Li, Jianping Zou, Gang Xiong, Kingsum Chow, Shuibing He, and Shuiguang Deng*.
Ziqi Wang, Hailiang Zhao*, Cheng Bao, Wenzhuo Qian, Yuhao Yang, Xueqiang Sun, and Shuiguang Deng*.
Wenzhuo Qian, Hailiang Zhao*, Jiayi Chen, Ziqi Wang, Tianlv Chen, Zhiwei Ling, Xinkui Zhao, Kingsum Chow, Albert Y. Zomaya, and Shuiguang Deng*.
担任《计算机工程与科学》青年编委,以及 NeurIPS、IJCAI-ECAI、AAAI、PAKDD 等会议审稿人;担任 IEEE TSC、TMC、FGCS、TKDD、IoTJ 等期刊审稿人。
面向课程学习和科研交流的讲义、方法说明与系统分析资料。