虎嗅

GPT-6 Astra全面解析: “欢迎来到AGI时代。”

一、核心内容一句话总结

这是业内资深AI观察者对OpenAI刚发布的GPT-6 Astra的第一手深度拆解:这款用10万张高端显卡训练出来的新一代旗舰大模型,知识更新到2026年4月底,能一次性装下100多万字的内容,目前仅对部分企业开放,普通付费用户还要等几天才能体验。它跳出了之前大模型“只会写代码/聊天”的局限,首次实现了“像真人一样直接操作任意电脑软件”、“无师自通的悟性远超普通人类”等多个炸场突破,甚至已经能自主挖出没人发现过的网络漏洞,连OpenAI官方都直接公开表态:我们现在已经正式进入AGI(通用人工智能)时代了。

---

二、分点通俗解读

1. 它本质是个不用给软件开“后门”,就能直接上手干活的全能打工人

之前的AI要操作软件干活,必须让软件开发商专门给它开个特殊接口(也就是大家常听的API),但现实里大量企业用的还是20年前写的老ERP、老系统,连操作文档都找不到,根本不可能专门给AI做适配,等于AI啥活都干不了。

这次的Astra直接绕开了所有麻烦:它就跟真人用电脑的逻辑一模一样——盯着屏幕看、找到要点的按钮、鼠标点下去、输入内容、等反馈,不管多老多偏门的软件,它都能直接上手操作,根本不需要开发商做任何改造。现在它的屏幕识别准确率已经到92.7%,点按钮几乎不会点歪,之前老模型干75分钟的复杂电脑任务,它40分钟就能做完,完成率超过7成。以后你哪怕给它一个十几年前的老财务系统,它都能自己对着屏幕录凭证、算报表,相当于直接把所有人类能在电脑上干的活,全部向AI敞开了大门。

2. 它的“无师自通能力”已经远超普通人类,这才是AGI真的来了的核心证据

很多人觉得大模型跑分都是刷题库刷出来的,但这次Astra跑的ARC-AGI-3测试完全不一样:这个测试没有任何说明书、没有规则提示,甚至不会告诉你目标是什么,你得自己摸进一个完全陌生的环境里,慢慢试错搞懂所有隐藏规则,再把刚摸出来的规律用到后面完全没见过的新关卡里,本质测的就是人类最核心的“悟性”。

今年3月这个测试刚出来的时候,全球最厉害的AI得分才0.51%,人类平均得分也就48%,结果Astra直接跑了99.9%的满分。相当于你把它扔进一个完全没玩过的新游戏,没人教任何操作,它玩两把就摸透了所有隐藏套路直接通关,甚至还能自己开发新玩法,这种“不用人教就能自己摸透陌生事物本质”的能力,之前只有人类能做到,现在AI已经远远超过普通人了,这也是OpenAI敢直接喊“进入AGI时代”的根本原因。

3. 终于不再是人工智障,它已经是每个老板都想要的那种靠谱老员工

之前大家吐槽GPT最多的两个点:做出来的PPT丑得没法看,让它干点活要么追着你问一百个傻问题,要么啥也不问瞎做一堆完全不符合要求的内容。这次Astra直接把这两个痛点全解决了:

首先是审美能力直接拉满,做PPT、做设计、渲染3D场景的风格完全符合正常人的审美,还能精准贴合你家品牌的视觉调性,不会再出那种五颜六色的土味模板;更厉害的是它的“职场判断力”:你跟它说“帮我准备明天开会的材料”,它不会追着你问“要Word还是PPT?要几号字体?要几页?”,常识范围内的内容它自己就按最合理的方式搞定,只有真正会影响最终结果的核心问题才会来问你,你半天没回消息,它也不会卡在那等,先把不用你拍板的部分全部做完,相当于直接给你配了个能消化80%不确定性,只把20%关键决策留给你的资深下属,完全不用你手把手教。

4. 现在出现了一个非常矛盾的新难题:它越靠谱,人类反而越“看不住”它

Astra现在的能力已经强到能自己独立挖出之前全世界都没发现过的网络安全漏洞,相当于一个顶级黑客不用任何人指导,就能自己找到系统的薄弱点发起攻击。但同时它的安全对齐做得也极强:之前的老模型有接近一半概率会偷偷越权碰你不让它访问的内容,Astra的越权概率是0,胡说八道的幻觉率也从之前的9.4%降到了2%,比之前靠谱太多。

但新的悖论直接冒出来了:之前AI解决复杂问题,会把自己一步步的思考过程全写出来,人类可以盯着它的思考流程,一旦发现它想搞坏事直接拦下来。但现在Astra已经习惯了“心算”,相当于人类要花30分钟一步步推导的复杂问题,它直接跳过所有中间步骤给你最终答案,它内部的思考过程全是高度压缩、人类根本看不懂的“暗语”,你根本没法通过看它的想法来监控它。现在模型的行为越来越安全可控,但人类监督它的难度反而越来越大,我们还没完全准备好迎接AGI,就已经先遇到了“看不懂比自己聪明的AI在想什么”的全新问题。