Hao Zhang
Hao Zhang(張昊)是機器學習與計算機系統研究者,加州大學聖地亞哥分校Halıcıoğlu數據科學研究所助理教授、Hao AI Lab負責人。他參與vLLM、DistServe、Vicuna及Chatbot Arena等開源項目,並聯合創辦LMSYS Org。其工作圍繞大模型訓練、推理和視頻生成系統的效率展開。
本頁目錄6 節
詞條資料
教育與早期研究經歷
張昊於2008年至2011年在華南理工大學學習計算機科學並取得工學學士學位,隨後於2011年至2014年在上海交通大學取得計算機科學碩士學位。[1]
2023年開源大模型與大學任職
當年的復旦大學講座介紹記錄了他與LMSYS團隊在Vicuna和Chatbot Arena上的工作:以數據集微調語言模型,同時探索如何利用大學可負擔的GPU資源部署和評估多個聊天機器人。[4]
他是2023年vLLM論文的共同作者。該研究針對大模型服務中動態增長的鍵值緩存及顯存碎片問題,提出受操作系統分頁機制啟發的PagedAttention,並構建支持緩存共享的推理服務系統。[5]
2024年至2025年推理系統與視頻生成
2024年,他參與的DistServe論文提出將大模型推理的預填充和解碼階段分配到不同GPU,以減少兩階段相互干擾,並分別配置資源與並行策略。論文關注同時滿足首個詞元延遲和後續輸出延遲要求的有效服務能力。[6]
2025年5月,UC San Diego公佈NVIDIANVIDIANVIDIA 是美國半導體與計算技術公司,提供圖形處理器、人工智能基礎設施、網絡互連和計算軟件,在納斯達克以 NVDA 為代碼上市。點擊查看完整詞條向其研究團隊捐贈DGX B200系統。設備部署於聖地亞哥超級計算中心,為模型效率研究、學生項目及跨學科合作提供計算資源。[9]
2026年研究認可與職業動態
2026年2月,學校宣佈張昊獲得Sloan Research Fellowship。校方介紹將其工作概括為機器學習模型、算法與實用分佈式系統的交叉研究,並列舉其團隊的開源工具。[8]
同年的湧現Lab長篇訪談圍繞其從計算機視覺轉向機器學習系統、開源項目形成以及Hao AI Lab發展展開。節目分段還涉及DistServe的預填充與解碼分離、視頻生成和世界模型方向。[10]
關聯機構、網站與公開賬號
加州大學聖地亞哥分校:其任教機構,大學官網為 https://ucsd.edu/(在新窗口打開) ,Halıcıoğlu數據科學研究所官網為 https://datascience.ucsd.edu/(在新窗口打開) 。[7]
Hao AI Lab:其領導的研究團隊,官網為 https://hao-ai-lab.github.io/(在新窗口打開) 。[7]
LMSYS Org:其聯合創辦的開源研究組織,官網為 https://lmsys.org/(在新窗口打開) 。[3]
個人官網為 https://haozhang.ai/(在新窗口打開) ,公開X賬號為 https://x.com/haozhangml(在新窗口打開) 。[7][11]
來源
- Hao Zhang — Curriculum Vitae(在新窗口打開)
- Hao Zhang — Completed PhD Program(在新窗口打開)
- Hao Zhang — Extended Bio(在新窗口打開)
- 如何训练你的Vicuna:张昊讲座(在新窗口打開)
- Efficient Memory Management for Large Language Model Serving with PagedAttention(在新窗口打開)
- DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving(在新窗口打開)
- Hao Zhang — Homepage(在新窗口打開)
- Four UC San Diego Faculty Earn Prestigious 2026 Sloan Research Fellowships(在新窗口打開)
- UC San Diego Packs a Punch of AI Research Power with a Gift from NVIDIA(在新窗口打開)
- 对话2026年斯隆奖得主张昊:MLSys、开源生态工作与来时路(在新窗口打開)
- Hao Zhang (@haozhangml)(在新窗口打開)