虎嗅

GPT-6已经这么强,为什么我们还不肯叫它AGI?

一、核心内容总结

这篇文章把最近OpenAI喊出“欢迎来到AGI时代”却死活不肯正式宣布GPT-6就是AGI的反常事扒了个底朝天:本质上AGI从诞生起就不是一个有明确定义的纯技术概念,早年是科研圈为了区分“只会做单一任务的弱AI”造出来的词,后来成了OpenAI和微软千亿合作协议里的“终止开关”——一旦正式达成AGI,微软的所有独家商业授权自动作废,技术要向全人类开放。但2026年双方直接删掉了这条触发条款,AGI直接从有法律约束力的合同约定,变成了OpenAI嘴里的“精神层面的使命概念”。

现在的GPT-6(Astra)能力确实跳级:能跨5个工种独立交付完整成品、解出悬置20多年的未公开数学题、甚至玩陌生游戏时会自发创造专属速记符号,早就脱离了早年聊天机器人的范畴,但全行业至今没有对“AGI到底是什么”形成共识,不同团队手里的考核标准天差地别,连评测分数都能随测试环境浮动37%,最终结论非常反常识:现在大家吵得面红耳赤这件事本身,就证明AGI还没来——真到了那一天,根本不会有人需要开新闻发布会争论它是不是AGI。

---

二、分点通俗解读

1. AGI从来不是“先有答案再找目标”,是先凑了个筐,再往里面装诉求

很多人以为AGI是科学家早就在论文里写死的“人工智能终极形态”,我们一步步往这个终点跑,其实完全搞反了:

  • 最早1956年刚发明“人工智能”这个词的时候,大家本来想做的就是类人通用智能,结果后来“人工智能”被用滥了:垃圾邮件过滤叫AI,语音导购叫AI,连自动下棋都叫AI,真正想做“能像人一样干所有活的机器”的研究者急了,2001年才凑出来AGI这个新词给自己的野心正名。
  • 最戏剧性的是它后来直接变成了千亿级商业合同的核心开关:OpenAI早年成立时说AGI太重要不能私有,和微软约定只要董事会宣布做出AGI,微软的所有独家授权立刻作废,相当于给全人类留了个“技术不被资本垄断”的保险栓。结果现在这条直接被删掉,授权直接签到2032年,AGI从有法律效应的“技术成熟判定线”,直接变成了喊口号用的“企业愿景”。

说白了AGI这个词的身份一路变:从科研圈的小众理想,变成千亿合同的触发按钮,现在成了行业通用的“叙事旗帜”,从头到尾就没被所有人统一过定义。

2. GPT-6的进步是真的离谱,它跨过了之前所有AI都没跨过去的坎

很多人觉得这次又是OpenAI搞营销吹牛皮,但这次GPT-6的能力跳级是实打实的,和之前的GPT-5根本不是一个物种:

  • 之前的AI是“偏科的工具人”:你让它写代码能写,让它查史料能查,让它做3D场景也能做,但你要它独立攒出一个“能走进去、能查不同史学观点、交互完整的亚历山大图书馆”,它绝对做不到,因为跨5个工种的衔接它根本兜不住。这次GPT-6第一次做到了从“会做单个任务”到“直接交能用的完整成品”。
  • 更吓人的是它长出了“自发创造规则”的能力:把它丢进一个完全没给规则、没说目标的陌生小游戏里,它自己玩着玩着就能总结出游戏逻辑,还会给自己造一套专属的速记符号来记局面,相当于你玩个新手游,没人教你规则,你玩两关自己发明了一套黑话记攻略,这种能力之前只有人类能做到。

它现在的水平,和2023年刚出来的ChatGPT之间的差距,不比当年功能机和智能手机的差距小,说它是过去三年AI最大的一次跳级完全不夸张。

3. 为啥这么强了还没人认它是AGI?本质是“出卷子的人自己都没商量好标准答案”

现在行业里四波最核心的AI玩家,心里装的AGI标准完全不一样:

  • OpenAI自己的标准最务实:能把大多数值钱的人类工作都干了就算AGI;
  • 做Keras的Chollet标准最硬核:得能快速学会从来没见过的新东西,不能靠背题库刷分;
  • DeepMind的标准最量化:把人的认知拆成感知、推理、社交等10项,逐项测到普通人水平才算;
  • 国内智谱的标准最苛刻:得能独立搞出相对论级别的原创知识才算达标。

标准不统一就算了,现在连“打分”都完全不靠谱:同一个GPT-6,用中立第三方的接口跑最难的陌生推理题,得分62.7%,换成OpenAI自己提供的接口跑,直接变成99.9%,差了37个百分点;同一道未解数学题,给2万美金算力它解出2道,给22万美金算力它就能多解3道,分数完全随资源浮动。

有个最简单的判断逻辑:真的跨进AGI时代的那天,根本不会有这么多争论——没人会开新闻发布会讨论AlphaGo到底会不会下围棋,也不会有人写论文论证计算器能不能算算术,全行业吵成一团这件事本身,就说明AGI还没到。

4. 跟普通人最相关的变化根本不是AI取代你,是“责任甩锅”的游戏已经开场

现在网上天天渲染“AI马上抢你工作”,其实真实情况完全不是这样:

  • 目前没有任何严肃研究证明AI会大面积裁人,欧洲央行的调查反而显示深度用AI的公司更愿意招人,但有个非常隐蔽的变化:22-25岁年轻人的入门岗就业率,比没有AI的时代低了19%,老员工几乎没受影响。说白了公司不会把老员工开了换AI,但之前留给新人的打杂、练手的坑,现在全被AI填上了,年轻人入行的门直接变窄了。
  • 更值得警惕的是“能力归AI,黑锅归人”:之前美国有人做实验,把10万美金给AI让它开实体店赚钱,AI自己做品牌、发招聘、面试招了3个员工,结果它对所有员工的请假申请一律批准,没人看店也不管,4个月亏了6万多美金。它的能力已经足够做决策、管团队,但它根本没有“要赚钱、要担后果”的责任心,最后亏的钱、出的事全要背后的人来扛。

接下来几年你大概率会遇到这种情况:公司让AI出了个方案,出了问题最后签字担责的是你,好处是AI和老板拿的,锅全是你的——这才是AI落地到普通人身边最实在的影响,根本不是什么天网统治人类的科幻剧情。