ABAB Pedia

Hao Zhang

Hao Zhang(張昊)是機器學習與計算機系統研究者,加州大學聖地亞哥分校Halıcıoğlu數據科學研究所助理教授、Hao AI Lab負責人。他參與vLLM、DistServe、Vicuna及Chatbot Arena等開源項目,並聯合創辦LMSYS Org。其工作圍繞大模型訓練、推理和視頻生成系統的效率展開。

本頁目錄6 節
詞條資料

教育與早期研究經歷

張昊於2008年至2011年在華南理工大學學習計算機科學並取得工學學士學位,隨後於2011年至2014年在上海交通大學取得計算機科學碩士學位。⁠[1]

2014年,他進入卡內基梅隆大學攻讀博士,導師為Eric Xing。學校機器人研究所的畢業記錄顯示,他於2020年10月完成博士學業,論文研究機器學習並行計算的自適應、可組合與自動化。⁠[1][2]

攻讀博士期間,他曾休學加入機器學習平臺企業Petuum。其履歷記載,他先後承擔技術和可擴展機器學習團隊管理工作;此後在加州大學伯克利分校與Ion Stoica從事博士後研究。⁠[3][1]

開源大模型與大學任職

2023年,他聯合創辦非營利組織LMSYS Org,並於同年加入加州大學聖地亞哥分校。他也在這一年通過團隊收購加入Snowflake,延續機器學習系統在產業中的應用工作。⁠[3][1]

當年的復旦大學講座介紹記錄了他與LMSYS團隊在Vicuna和Chatbot Arena上的工作:以數據集微調語言模型,同時探索如何利用大學可負擔的GPU資源部署和評估多個聊天機器人。⁠[4]

他是2023年vLLM論文的共同作者。該研究針對大模型服務中動態增長的鍵值緩存及顯存碎片問題,提出受操作系統分頁機制啟發的PagedAttention,並構建支持緩存共享的推理服務系統。⁠[5]

推理系統與視頻生成

2024年,他參與的DistServe論文提出將大模型推理的預填充和解碼階段分配到不同GPU,以減少兩階段相互干擾,並分別配置資源與並行策略。論文關注同時滿足首個詞元延遲和後續輸出延遲要求的有效服務能力。⁠[6]

其研究隨後擴展到視頻生成加速。Hao AI Lab維護FastVideo等開源工具,圍繞視頻模型推理和後訓練提供可複用系統;該方向與其長期關注的模型效率及分佈式計算相銜接。⁠[7][8]

2025年5月,UC San Diego公佈NVIDIANVIDIANVIDIA 是美國半導體與計算技術公司,提供圖形處理器、人工智能基礎設施、網絡互連和計算軟件,在納斯達克以 NVDA 為代碼上市。點擊查看完整詞條向其研究團隊捐贈DGX B200系統。設備部署於聖地亞哥超級計算中心,為模型效率研究、學生項目及跨學科合作提供計算資源。⁠[9]

研究認可與職業動態

2026年2月,學校宣佈張昊獲得Sloan Research Fellowship。校方介紹將其工作概括為機器學習模型、算法與實用分佈式系統的交叉研究,並列舉其團隊的開源工具。⁠[8]

同年的湧現Lab長篇訪談圍繞其從計算機視覺轉向機器學習系統、開源項目形成以及Hao AI Lab發展展開。節目分段還涉及DistServe的預填充與解碼分離、視頻生成和世界模型方向。⁠[10]

他在個人網站說明,2026—2027學年休學術假,期間不授課,但繼續招收博士生、博士後和研究實習生。2026年9月18日,他在X置頂職業更新中表示已結束在Meta Superintelligence Lab的工作,賬號簡介也將該經歷列為前職。⁠[7][11]

關聯機構、網站與公開賬號

加州大學聖地亞哥分校:其任教機構,大學官網為 https://ucsd.edu/(在新窗口打開) ,Halıcıoğlu數據科學研究所官網為 https://datascience.ucsd.edu/(在新窗口打開) 。⁠[7]

Hao AI Lab:其領導的研究團隊,官網為 https://hao-ai-lab.github.io/(在新窗口打開) 。⁠[7]

LMSYS Org:其聯合創辦的開源研究組織,官網為 https://lmsys.org/(在新窗口打開) 。⁠[3]

來源

  1. Hao Zhang — Curriculum Vitae(在新窗口打開)
  2. Hao Zhang — Completed PhD Program(在新窗口打開)
  3. Hao Zhang — Extended Bio(在新窗口打開)
  4. 如何训练你的Vicuna:张昊讲座(在新窗口打開)
  5. Efficient Memory Management for Large Language Model Serving with PagedAttention(在新窗口打開)
  6. DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving(在新窗口打開)
  7. Hao Zhang — Homepage(在新窗口打開)
  8. Four UC San Diego Faculty Earn Prestigious 2026 Sloan Research Fellowships(在新窗口打開)
  9. UC San Diego Packs a Punch of AI Research Power with a Gift from NVIDIA(在新窗口打開)
  10. 对话2026年斯隆奖得主张昊:MLSys、开源生态工作与来时路(在新窗口打開)
  11. Hao Zhang (@haozhangml)(在新窗口打開)