第一财经

Transformer先驱离开谷歌加入OpenAI,奥尔特曼:等了10年

该文章尚未提供 日本語 解读,以下为中文版内容。

核心内容总结

谷歌DeepMind的顶级AI人才诺姆·沙泽尔(Noam Shazeer)——Transformer架构(所有大模型的技术基础)和稀疏混合专家模型(MoE,让模型更高效的关键技术)的核心贡献者、谷歌Gemini模型的联合负责人——在被谷歌花27亿美元请回不到两年后,宣布加入OpenAI担任架构研究负责人。这一变动发生在OpenAI提交IPO文件的关键节点,被业内称为“今年最重要的AI人才流动”,将直接影响谷歌与OpenAI在大模型赛道的竞争格局。

一、这个离开谷歌的人,到底有多“神”?

沙泽尔在AI圈是“扫地僧”级别的存在:

  • 大模型的“地基”设计者:他是《Attention Is All You Need》论文的核心作者之一,这篇论文首次提出Transformer架构——现在ChatGPT、Gemini、文心一言等所有主流大模型,都用的是这个技术,论文被引用超25万次,相当于AI界的“圣经”。
  • 让模型“更聪明又省钱”的先驱:他发明的MoE模型,解决了大模型“算力不够用”的问题——简单说,就是让模型只调用需要的部分(像专家分工),既提升性能又减少算力消耗,现在几乎所有大厂都在用这个技术。
  • 谷歌Gemini的“救星”:回归谷歌后,他主导Gemini的预训练,解决了关键技术问题,让Gemini性能大幅提升,缩小了和ChatGPT的差距,甚至一度让谷歌反超OpenAI。
  • 行业认可的“大佬”:2023年被《时代》评为全球AI最具影响力100人,OpenAI CEO奥尔特曼等了他10年才终于合作。

二、谷歌又留不住人才?背后可能有这些“老毛病”

沙泽尔不是第一次离开谷歌:

  • 第一次出走:因为谷歌太保守:2020年他开发了聊天机器人Meena,但谷歌担心安全风险不敢发布,他一气之下创业做了Character.AI(估值10亿美元的独角兽)。
  • 这次再走:可能还是“慢半拍”:2024年谷歌花27亿把他请回来,不到两年又走——外界猜测,谷歌内部可能还是存在“技术落地慢”“决策流程繁琐”的问题。比如Gemini虽然性能提升,但产品化速度可能不如OpenAI(OpenAI最近两个月连续推出GPT Images 2、GPT-5.5,动作很快)。
  • 人才流失的连锁反应:沙泽尔是谷歌AI的核心支柱,他的离开被称为“巨大损失”,可能会影响谷歌后续模型的研发进度,尤其是在OpenAI强势反扑的阶段。

三、OpenAI捡了大便宜?IPO前招他有“双重好处”

OpenAI在提交IPO文件的关键时候招到沙泽尔,简直是“神操作”:

  • 技术上“如虎添翼”:沙泽尔担任架构研究负责人,直接负责模型的底层设计——这意味着OpenAI未来的模型可能在效率、性能上有更大突破(比如优化GPT-5.5或下一代模型)。
  • 给投资者“吃定心丸”:AI公司的核心资产就是人才,沙泽尔这样的顶级人才加入,会让投资者更相信OpenAI的技术实力和未来潜力,对IPO估值和市场信心都有帮助。
  • 奥尔特曼的“十年心愿”:奥尔特曼说“等了10年”,可见沙泽尔的价值——OpenAI现在需要这样的“技术压舱石”来巩固领先地位。

四、大模型赛道:没有“永恒的老大”,只有“永恒的抢人战”

这次人才流动,再次证明大模型竞争的核心是“抢人才”:

  • 攻守之势随时变:几个月前谷歌Gemini还反超OpenAI,现在OpenAI靠GPT-5.5和沙泽尔的加入又占上风——大模型领域没有谁能“躺赢”。
  • 人才是“护城河”:AI技术更新极快,顶级人才掌握着最核心的突破点。比如沙泽尔的MoE技术,直接影响模型的成本和性能,谁拥有这样的人才,谁就有更大优势。
  • 未来的“蝴蝶效应”:沙泽尔加入OpenAI后,可能会把他在谷歌的经验(比如Gemini的优化方法)带到OpenAI,同时也可能加速OpenAI在AGI(通用人工智能)上的进展——这对整个AI行业的发展方向都会有影响。

最后一句话总结

沙泽尔的流动,不是一个简单的“跳槽”,而是大模型赛道“你追我赶”的缩影:谷歌的保守可能让它失去优势,OpenAI的灵活和野心正在吸引最顶尖的人才,未来谁能坐稳“王座”,还要看更多这样的关键变动。