ABAB Pedia

Goodfire

Goodfire 是2024年成立、总部位于旧金山的人工智能可解释性研究公司,以公益公司形式运营。公司由 Eric Ho、Tom McGrath 和 Daniel Balsam 共同创办,研究神经网络内部机制,并开发 Ember、Silico 等模型解释、调试和监测工具。

本页目录11 节
词条资料

创办与研究方向

Goodfire 由 Eric Ho、Tom McGrath 与 Daniel(Dan)Balsam 创办。Ho 曾共同创办人工智能招聘公司 RippleMatch;McGrath 曾在 Google DeepMindGoogle DeepMindGoogle DeepMind 是 Google 旗下的人工智能研究机构,2023年4月由2014年被 Google 收购的 DeepMind 与 Google Research 的 Brain 团队合并而成,由 Demis Hassabis 任首席执行官。它开发了 AlphaGo、AlphaFold 和 Gemini 系列模型,Hassabis 与 John Jumper 因 AlphaFold 的蛋白质结构预测工作获得2024年诺贝尔化学奖。点击查看完整词条 建立可解释性研究团队;Balsam 曾任 RippleMatch 创始工程师及人工智能负责人。团队希望把神经网络内部分析转化为开发者可用的调试工具。⁠[1][2]

700万美元种子轮

LightspeedLightspeed Venture PartnersLightspeed Venture Partners支持从种子轮到后期融资阶段的企业。其官网区分Lightspeed Management Company(LSVP)与Lightspeed India Partners(LSIP):两者是分别运营的投资顾问实体,美国、欧洲和以色列办公室属于LSVP,印度及东南亚办公室属于LSIP。点击查看完整词条 宣布领投 Goodfire 的700万美元种子轮。其投资说明把产品定位为研究、可视化及调整模型内部概念的基础工具,区别于仅依赖训练数据或提示词改变模型输出的方法。Menlo 的组合档案记载其在2024年种子阶段参与投资。⁠[2][1]

开放稀疏自编码器

继 Ember 发布后,公司开放用于 Llama 3.1 8B 和 Llama 3.3 70B 的稀疏自编码器(SAE)。这类解释模型把神经网络的复杂激活分解为较易理解的特征,也为 Ember 的 API 和 SDK 提供特征发现与行为调整能力。模型权重、文档和示例面向研究者开放。⁠[3]

5000万美元A轮

1.5亿美元B轮

公司宣布以12.5亿美元估值融资1.5亿美元,由 B Capital 领投,Juniper Ventures、DFJ Growth、Salesforce Ventures、Menlo、Lightspeed 等参与。公告将模型设计环境的应用分为两类:理解并调整模型行为,以及从科学模型中提取可供研究者检验的知识;合作方包括 Arc Institute、Mayo Clinic 与 MicrosoftMicrosoftMicrosoft(微软)是由 Bill Gates 和 Paul Allen 于1975年创办、总部位于美国华盛顿州雷德蒙德的科技公司,业务涵盖 Windows、Microsoft 365、Azure、企业软件、人工智能、游戏和设备。点击查看完整词条。⁠[5]

Silico 研究资助

Goodfire 推出研究资助计划,向获选的大学及非营利研究团队提供合计价值100万美元的 Silico 使用额度。支持方向包括人工智能安全、基础可解释性与对齐,以及生命科学中的可解释性研究;这是工具使用资助,而非同额现金基金。⁠[6]

与 Baseten 合作

Goodfire 与 Baseten 宣布 Project Beacon,计划把前者的模型内部激活监测与后者的推理平台结合,用于识别提示注入、敏感数据泄露、网络滥用等风险。系统可先用小型分类器筛选,再交由模型评判或人工流程处理;客户可配置记录、复核、拒绝和重新路由等响应。公告中的检测率来自公司特定评测,并不表示能消除所有风险。⁠[7]

主题:Silico 与研究工作流

Silico 是 Goodfire 的可解释性研究代理与模型设计环境。用户给出研究目标后,代理可规划实验、并行执行、监测进度并返回可检查的结果。其工具覆盖 SAE、探针、因果分析、模型比较和数据归因,面向语言模型、生命科学、机器人及视觉模型;官网提供 macOS 客户端与团队部署接洽入口。⁠[8]

主题:公司形态与技术目标

Goodfire 总部位于旧金山,以公益公司形式运营,团队包含来自 OpenAIOpenAIOpenAI是2015年创立的人工智能研究与产品机构,开发GPT系列模型、ChatGPT、Codex及开发者API,并开展图像、语音、视频与智能代理研究。2025年重组后,非营利的OpenAI Foundation继续控制营利主体OpenAI Group PBC。其发展涉及大规模融资与算力合作,也伴随治理、版权、隐私及人工智能安全争议。点击查看完整词条、Google DeepMind 等机构的研究人员和工程师。其核心方向是机制可解释性:研究模型内部表征与计算过程,帮助解释、监测和干预模型行为。理解与对齐模型是公司的研究目标,不能据此断言现有模型已被完全解释或实现安全保证。⁠[9][5]

官方网站与公开账号

来源

  1. Deedy Das | Menlo Ventures(在新窗口打开)
  2. Goodfire: Building Interpretable AI(在新窗口打开)
  3. Announcing Open-Source SAEs for Llama 3.3 70B and Llama 3.1 8B(在新窗口打开)
  4. Announcing Our $50M Series A to Advance AI Interpretability Research(在新窗口打开)
  5. Understanding, Learning From, and Designing AI: Our Series B(在新窗口打开)
  6. Announcing Goodfire Research Grants(在新窗口打开)
  7. Goodfire and Baseten partner to bring frontier safety to open models(在新窗口打开)
  8. Silico — your interpretability agent(在新窗口打开)
  9. About Goodfire(在新窗口打开)
  10. Goodfire (@GoodfireAI)(在新窗口打开)
  11. Goodfire | LinkedIn(在新窗口打开)