Hao Zhang
Hao Zhang(张昊)是机器学习与计算机系统研究者,加州大学圣地亚哥分校Halıcıoğlu数据科学研究所助理教授、Hao AI Lab负责人。他参与vLLM、DistServe、Vicuna及Chatbot Arena等开源项目,并联合创办LMSYS Org。其工作围绕大模型训练、推理和视频生成系统的效率展开。
本页目录6 节
词条资料
教育与早期研究经历
张昊于2008年至2011年在华南理工大学学习计算机科学并取得工学学士学位,随后于2011年至2014年在上海交通大学取得计算机科学硕士学位。[1]
2023年开源大模型与大学任职
当年的复旦大学讲座介绍记录了他与LMSYS团队在Vicuna和Chatbot Arena上的工作:以数据集微调语言模型,同时探索如何利用大学可负担的GPU资源部署和评估多个聊天机器人。[4]
他是2023年vLLM论文的共同作者。该研究针对大模型服务中动态增长的键值缓存及显存碎片问题,提出受操作系统分页机制启发的PagedAttention,并构建支持缓存共享的推理服务系统。[5]
2024年至2025年推理系统与视频生成
2024年,他参与的DistServe论文提出将大模型推理的预填充和解码阶段分配到不同GPU,以减少两阶段相互干扰,并分别配置资源与并行策略。论文关注同时满足首个词元延迟和后续输出延迟要求的有效服务能力。[6]
2025年5月,UC San Diego公布NVIDIA向其研究团队捐赠DGX B200系统。设备部署于圣地亚哥超级计算中心,为模型效率研究、学生项目及跨学科合作提供计算资源。[9]
2026年研究认可与职业动态
2026年2月,学校宣布张昊获得Sloan Research Fellowship。校方介绍将其工作概括为机器学习模型、算法与实用分布式系统的交叉研究,并列举其团队的开源工具。[8]
同年的涌现Lab长篇访谈围绕其从计算机视觉转向机器学习系统、开源项目形成以及Hao AI Lab发展展开。节目分段还涉及DistServe的预填充与解码分离、视频生成和世界模型方向。[10]
关联机构、网站与公开账号
加州大学圣地亚哥分校:其任教机构,大学官网为 https://ucsd.edu/(在新窗口打开) ,Halıcıoğlu数据科学研究所官网为 https://datascience.ucsd.edu/(在新窗口打开) 。[7]
Hao AI Lab:其领导的研究团队,官网为 https://hao-ai-lab.github.io/(在新窗口打开) 。[7]
LMSYS Org:其联合创办的开源研究组织,官网为 https://lmsys.org/(在新窗口打开) 。[3]
个人官网为 https://haozhang.ai/(在新窗口打开) ,公开X账号为 https://x.com/haozhangml(在新窗口打开) 。[7][11]
来源
- Hao Zhang — Curriculum Vitae(在新窗口打开)
- Hao Zhang — Completed PhD Program(在新窗口打开)
- Hao Zhang — Extended Bio(在新窗口打开)
- 如何训练你的Vicuna:张昊讲座(在新窗口打开)
- Efficient Memory Management for Large Language Model Serving with PagedAttention(在新窗口打开)
- DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving(在新窗口打开)
- Hao Zhang — Homepage(在新窗口打开)
- Four UC San Diego Faculty Earn Prestigious 2026 Sloan Research Fellowships(在新窗口打开)
- UC San Diego Packs a Punch of AI Research Power with a Gift from NVIDIA(在新窗口打开)
- 对话2026年斯隆奖得主张昊:MLSys、开源生态工作与来时路(在新窗口打开)
- Hao Zhang (@haozhangml)(在新窗口打开)