ABAB Pedia

Christopher Olah

Christopher Olah(通稱 Chris Olah)是機器學習研究者、AnthropicAnthropicAnthropic是一家於2021年成立的人工智能研究與產品公司,開發Claude模型、助手及Claude Code等工具,並以公益公司形式運營。Dario Amodei與Daniela Amodei為共同創辦人,其研究涉及模型安全、可解釋性和可控性。點擊查看完整詞條 聯合創始人,研究神經網絡可解釋性。他曾在 Google Brain 任研究科學家、在 OpenAIOpenAIOpenAI是2015年創立的人工智能研究與產品機構,開發GPT系列模型、ChatGPT、Codex及開發者API,並開展圖像、語音、視頻與智能代理研究。2025年重組後,非營利的OpenAI Foundation繼續控制營利主體OpenAI Group PBC。其發展涉及大規模融資與算力合作,也伴隨治理、版權、隱私及人工智能安全爭議。點擊查看完整詞條 領導 Clarity 團隊,並創辦學術期刊 Distill。

本頁目錄13 節
詞條資料

加入多倫多 hacklab.to

Olah 自2009年起是多倫多黑客空間 hacklab.to 的成員,2012年2月至2014年2月任該組織董事。2011年至2013年,他創辦開源項目 ImplicitCAD,這是一種以 Haskell 編寫、可編譯為三維物體的編程語言。2011年5月,他公開了 Unbound DNS 解析器的一個分佈式拒絕服務(DDoS)漏洞(CVE-2011-1922)。⁠[1][1][1]

獲得 Thiel Fellowship

2012年7月,19歲的 Olah 獲得 Thiel Fellowship。該項目向20歲以下、從事研究或創業的人提供10萬美元資助,鼓勵他們不經大學直接投入研究或創業。Olah 沒有上大學,未取得大學學位。⁠[1][2][3]

進入 Google Brain 實習

2014年7月至10月,Olah 在 Google Brain 實習,由 Jeff DeanJeff DeanJeff Dean 是計算機科學家、軟件工程師,Discovery Loop 聯合創始人兼首席執行官,曾任 Google 首席科學家。他於1999年加入 Google,參與 MapReduce、Bigtable、Spanner、TensorFlow 與機器學習基礎設施建設,2026年8月離開 Google 創業。同年7月,他在 Y Combinator Startup School 討論 AI 創業、工程優化與自動化研究。點擊查看完整詞條 指導,研究用交互式媒介呈現神經網絡的內部表示,並提出可視化神經網絡空間的 meta-SNE 算法。2015年5月至10月他再度實習,由 Greg Corrado 指導;2015年10月轉任研究助理,2016年10月起任研究科學家,至2018年。⁠[1][1][1]

在 Google Brain 期間,他於2015年8月在個人博客發表解釋長短期記憶網絡的文章《Understanding LSTM Networks》,並列名為2015年 TensorFlow 系統論文的作者之一。⁠[1][1]

參與發佈 DeepDream

2015年6月,GoogleGoogleGoogle是一家美國科技公司,由Larry Page與Sergey Brin創辦,1998年註冊成立,2015年成為Alphabet旗下企業。其業務涵蓋互聯網搜索、廣告、軟件平臺、雲計算及人工智能。點擊查看完整詞條 Research 博客發表《Inceptionism: Going Deeper into Neural Networks》,作者為 Alexander Mordvintsev、時任軟件工程實習生的 Olah 與 Mike Tyka。這次發佈即後來廣為人知的 DeepDream 神經網絡圖像可視化,Olah 為第二作者。⁠[4][3]

創辦 Distill

2016年,Olah 創辦學術期刊 Distill 並任編輯,另一位編輯為 Shan Carter。期刊以網頁原生的交互圖示發表解釋機器學習研究的文章,於2016年至2021年運作,此後無限期停刊。⁠[1][5][5][5]

合著《Concrete Problems in AI Safety》

加入 OpenAI 領導 Clarity 團隊

2018年10月,Olah 加入 OpenAI 任技術人員,領導新成立的 Clarity 團隊,研究神經網絡可解釋性。2019年3月,他與 Shan Carter、Zan Armstrong、Ludwig Schubert、Ian Johnson 在 Distill 發表《Activation Atlases》。他領導 OpenAI 可解釋性團隊至2020年12月。⁠[1][1][3]

聯合創辦 Anthropic

2021年,Olah 與另外六名前 OpenAI 員工共同創辦專注於大型模型安全的人工智能實驗室 Anthropic,並在 Anthropic 繼續從事可解釋性研究。⁠[2][6][3]

在 Claude 中識別數百萬“特徵”

2024年5月21日,Olah 領導的 Anthropic 機械可解釋性(mechanistic interpretability)團隊發表論文。這個18人的團隊用“字典學習”方法,在 Claude Sonnet 模型中找出數以百萬計的“特徵”,即同時激活時對應某一概念的神經元組合,其中包括與金門大橋相關的特徵,以及與生物戰等安全議題相關的特徵。⁠[7][7][7][7][7][7]

在梵蒂岡通諭發佈會上發言

2026年5月25日,教宗良十四世發佈以人工智能為主題的通諭《Magnifica humanitas》。Olah 受邀在梵蒂岡的通諭發佈會上發言,這是 Anthropic 擴大人工智能議題對話的舉措之一。他在發言中說,包括 Anthropic 在內的每個前沿人工智能實驗室,都處在有時會與“做正確的事”相沖突的激勵與約束之中,因此需要有身處這些激勵之外的人關注和批評這項技術;他還說,人工智能模型不像橋梁或飛機那樣被設計出來,而是“生長”出來的。⁠[8][8][8][8]

主題:研究方向、國籍與身家

Olah 把自己的工作描述為將人工神經網絡逆向工程為人類可理解的算法;他現任 Anthropic 可解釋性研究負責人,國籍為加拿大。⁠[6][2][2]

Forbes 實時富豪榜2026年10月2日估算 Olah 的淨資產為155億美元,當日排名全球第183位。⁠[2]

關聯機構、網站與公開賬號

來源

  1. Chris Olah CV(在新窗口打開)
  2. Christopher Olah(在新窗口打開)
  3. Chris Olah on what the hell is going on inside neural networks(在新窗口打開)
  4. Inceptionism: Going Deeper into Neural Networks(在新窗口打開)
  5. Distill is dedicated to making machine learning clear and dynamic(在新窗口打開)
  6. About Me - colah's blog(在新窗口打開)
  7. AI Is a Black Box. Anthropic Figured Out a Way to Look Inside(在新窗口打開)
  8. Anthropic co-founder Chris Olah's remarks on Pope Leo XIV's encyclical "Magnifica humanitas"(在新窗口打開)
  9. Chris Olah (@ch402) / X(在新窗口打開)
  10. Christopher Olah | LinkedIn(在新窗口打開)