虎嗅

那个当面把马斯克怼到破防的刺头,也离开OpenAI 了

核心内容总结

这篇文章讲了一个叫Joshua Achiam的AI安全研究者在OpenAI的经历,以及OpenAI从“安全优先”到商业化的转变。8年前,他在马斯克离职演讲上怼对方AGI计划不安全,被骂“蠢驴”,同事送他金色驴屁股雕像;后来他负责OpenAI的“使命对齐团队”(确保公司不偏离“AGI惠及全人类”的目标),但团队16个月就被解散,他转成“首席未来学家”(听起来像“闲职”);最终他离职,而OpenAI正准备上市,大量安全团队人员流失。同时,Achiam不是极端的AI末日论者,他反对危言耸听,但坚持AI安全重要,还靠OpenAI股票赚了上千万。

一、金色驴屁股雕像:8年前怼首富的年轻人,现在怎么样了?

2018年马斯克离开OpenAI董事会时,25岁的Achiam刚入职几个月,就在全体员工面前打断他的演讲:“你在Tesla搞AGI的计划不安全、太鲁莽!”马斯克当场发飙骂他“蠢驴”。后来同事(现在都是AI圈大佬:Dario Amodei创办Anthropic,David Luan搞过亚马逊AGI实验室)给他做了个金色驴屁股雕像,刻着“永远不要停止为安全做蠢驴”。8年后,这个雕像被OpenAI律师拿到马斯克起诉奥特曼的法庭当证据,法官没要,但它让全世界知道了Achiam——那个敢怼世界首富的安全研究者。现在,Achiam也离开了OpenAI。

二、OpenAI的安全团队去哪了?使命对齐小组说散就散

2024年9月,OpenAI成立“使命对齐团队”,让Achiam当负责人,任务是确保公司做事不偏离“AGI惠及全人类”的使命。但这个6-7人的小团队只活了16个月,2026年2月悄无声息解散,成员被分到各部门。更糟的是,OpenAI其他安全线也在收缩:负责“超级对齐”(让AI听人类话)的Jan Leike去了Anthropic;研究AI危险能力的Steven Adler和政策专家Miles Brundage离职创NGO,倡导严格安全标准;处理ChatGPT情绪支持的Andrea Vallone也去了Anthropic。OpenAI发言人说“安全工作由全公司承担”,但明眼人都懂:专门盯安全的人没了,安全优先级下降了。

三、Achiam的AI安全观:不相信末日,但也不想当“睁眼瞎”

Achiam不是那种喊“AI10年内灭绝人类”的极端派。他在X上骂AI安全圈的“末日论代表”Eliezer Yudkowsky:“你会害死研究者,你的极端言论没用,预测全错!”他认为10年内人类灭绝概率只有百万分之一,说那些喊5%-10%概率的人“不清醒”。但他也支持AI监管和安全,只是讨厌安全派站在道德高地上指责别人。更有意思的是,他卖了至少1000万OpenAI股票,还持有数千万——他不是不食人间烟火的理想主义者,而是既坚持安全,又能从公司发展中获益的“现实派”。

四、OpenAI变了:从“安全第一”到准备上市,理想让位于商业?

OpenAI原本是个非盈利实验室,目标是“安全开发AGI”。但现在它准备上市,商业化优先级越来越高。安全团队的收缩、大量安全人才流失,都是这个转变的信号。Achiam离职信里说“世界已经知道秘密了,在外面也能做使命”——这个“秘密”可能就是:OpenAI不再是那个为安全而战的实验室,而是一家要赚钱的科技公司了。他离开时,前同事们要么去了竞品Anthropic,要么自己搞安全NGO,说明很多人对OpenAI的转变失望。

最后:AI安全与商业的矛盾,才刚刚开始

Achiam的故事折射出AI行业的一个核心矛盾:要快速商业化赚钱,还是要慢下来确保安全?OpenAI选择了前者,而像Achiam这样的安全研究者,要么妥协,要么离开。未来,AI公司如何平衡这两者,可能会决定人类与AI的关系走向——毕竟,AGI真的来了,安全可不是小事。但现在看来,商业的力量似乎暂时占了上风。