ABAB Pedia

Christopher Olah

Christopher Olah(通称 Chris Olah)是机器学习研究者、Anthropic 联合创始人,研究神经网络可解释性。他曾在 Google Brain 任研究科学家、在 OpenAIOpenAIOpenAI是2015年创立的人工智能研究与产品机构,开发GPT系列模型、ChatGPT、Codex及开发者API,并开展图像、语音、视频与智能代理研究。2025年重组后,非营利的OpenAI Foundation继续控制营利主体OpenAI Group PBC。其发展涉及大规模融资与算力合作,也伴随治理、版权、隐私及人工智能安全争议。点击查看完整词条 领导 Clarity 团队,并创办学术期刊 Distill。

本页目录13 节
词条资料

加入多伦多 hacklab.to

Olah 自2009年起是多伦多黑客空间 hacklab.to 的成员,2012年2月至2014年2月任该组织董事。2011年至2013年,他创办开源项目 ImplicitCAD,这是一种以 Haskell 编写、可编译为三维物体的编程语言。2011年5月,他公开了 Unbound DNS 解析器的一个分布式拒绝服务(DDoS)漏洞(CVE-2011-1922)。⁠[1][1][1]

获得 Thiel Fellowship

2012年7月,19岁的 Olah 获得 Thiel Fellowship。该项目向20岁以下、从事研究或创业的人提供10万美元资助,鼓励他们不经大学直接投入研究或创业。Olah 没有上大学,未取得大学学位。⁠[1][2][3]

进入 Google Brain 实习

2014年7月至10月,Olah 在 Google Brain 实习,由 Jeff DeanJeff DeanJeff Dean 是计算机科学家、软件工程师,Discovery Loop 联合创始人兼首席执行官,曾任 Google 首席科学家。他于1999年加入 Google,参与 MapReduce、Bigtable、Spanner、TensorFlow 与机器学习基础设施建设,2026年8月离开 Google 创业。同年7月,他在 Y Combinator Startup School 讨论 AI 创业、工程优化与自动化研究。点击查看完整词条 指导,研究用交互式媒介呈现神经网络的内部表示,并提出可视化神经网络空间的 meta-SNE 算法。2015年5月至10月他再度实习,由 Greg Corrado 指导;2015年10月转任研究助理,2016年10月起任研究科学家,至2018年。⁠[1][1][1]

在 Google Brain 期间,他于2015年8月在个人博客发表解释长短期记忆网络的文章《Understanding LSTM Networks》,并列名为2015年 TensorFlow 系统论文的作者之一。⁠[1][1]

参与发布 DeepDream

2015年6月,Google Research 博客发表《Inceptionism: Going Deeper into Neural Networks》,作者为 Alexander Mordvintsev、时任软件工程实习生的 Olah 与 Mike Tyka。这次发布即后来广为人知的 DeepDream 神经网络图像可视化,Olah 为第二作者。⁠[4][3]

创办 Distill

2016年,Olah 创办学术期刊 Distill 并任编辑,另一位编辑为 Shan Carter。期刊以网页原生的交互图示发表解释机器学习研究的文章,于2016年至2021年运作,此后无限期停刊。⁠[1][5][5][5]

合著《Concrete Problems in AI Safety》

加入 OpenAI 领导 Clarity 团队

2018年10月,Olah 加入 OpenAI 任技术人员,领导新成立的 Clarity 团队,研究神经网络可解释性。2019年3月,他与 Shan Carter、Zan Armstrong、Ludwig Schubert、Ian Johnson 在 Distill 发表《Activation Atlases》。他领导 OpenAI 可解释性团队至2020年12月。⁠[1][1][3]

联合创办 Anthropic

2021年,Olah 与另外六名前 OpenAI 员工共同创办专注于大型模型安全的人工智能实验室 Anthropic,并在 Anthropic 继续从事可解释性研究。⁠[2][6][3]

在 Claude 中识别数百万“特征”

2024年5月21日,Olah 领导的 Anthropic 机械可解释性(mechanistic interpretability)团队发表论文。这个18人的团队用“字典学习”方法,在 Claude Sonnet 模型中找出数以百万计的“特征”,即同时激活时对应某一概念的神经元组合,其中包括与金门大桥相关的特征,以及与生物战等安全议题相关的特征。⁠[7][7][7][7][7][7]

在梵蒂冈通谕发布会上发言

2026年5月25日,教宗良十四世发布以人工智能为主题的通谕《Magnifica humanitas》。Olah 受邀在梵蒂冈的通谕发布会上发言,这是 Anthropic 扩大人工智能议题对话的举措之一。他在发言中说,包括 Anthropic 在内的每个前沿人工智能实验室,都处在有时会与“做正确的事”相冲突的激励与约束之中,因此需要有身处这些激励之外的人关注和批评这项技术;他还说,人工智能模型不像桥梁或飞机那样被设计出来,而是“生长”出来的。⁠[8][8][8][8]

主题:研究方向、国籍与身家

Olah 把自己的工作描述为将人工神经网络逆向工程为人类可理解的算法;他现任 Anthropic 可解释性研究负责人,国籍为加拿大。⁠[6][2][2]

Forbes 实时富豪榜2026年10月2日估算 Olah 的净资产为155亿美元,当日排名全球第183位。⁠[2]

关联机构、网站与公开账号

来源

  1. Chris Olah CV(在新窗口打开)
  2. Christopher Olah(在新窗口打开)
  3. Chris Olah on what the hell is going on inside neural networks(在新窗口打开)
  4. Inceptionism: Going Deeper into Neural Networks(在新窗口打开)
  5. Distill is dedicated to making machine learning clear and dynamic(在新窗口打开)
  6. About Me - colah's blog(在新窗口打开)
  7. AI Is a Black Box. Anthropic Figured Out a Way to Look Inside(在新窗口打开)
  8. Anthropic co-founder Chris Olah's remarks on Pope Leo XIV's encyclical "Magnifica humanitas"(在新窗口打开)
  9. Chris Olah (@ch402) / X(在新窗口打开)
  10. Christopher Olah | LinkedIn(在新窗口打开)