第一财经

Anthropic发新模型,OpenAI同日预告新品将安全优先

该文章尚未提供 Deutsch 解读,以下为中文版内容。

核心内容总结

近期,Anthropic、OpenAI、谷歌等AI头部厂商密集发布或预告新模型,标志着前沿AI模型的竞争在短暂“熄火”后重新提速。与以往单纯比拼性能分数不同,本轮竞争新增了“安全”这条关键主线——厂商们在提升模型能力(如编程、知识工作、网络安全分析)的同时,集体将安全部署从后台推向台前:不仅各自加强安全措施(如暂停高风险训练、推迟发布以完善防护),还联合发起网络防御集体行动,应对AI可能带来的网络攻击威胁。能力与安全的同步推进,成为下一阶段AI模型竞争的核心命题。

一、头部厂商集体“上新”,模型竞争重启

最近AI圈的“大佬们”动作不断:

  • Anthropic 直接推出了Claude Fable 5.1和Mythos 5.1,喊出“世界最先进编程和知识工作模型”的口号;
  • OpenAI 紧随其后,预告最新模型Astra很快发布,但把最牛的网络安全功能只给一小部分人测试;
  • 谷歌 也在暗中发力,开发更强的编码模型,想缩小和前两家的差距。

这些动作集中在同一时间,说明之前短暂放缓的模型竞争又开始“卷”起来了——不过这次不是只比谁的模型“更聪明”,而是多了“安全”这个重要考点。

二、Anthropic新模型:性能涨了,但单次任务成本反而升了

Anthropic的Fable 5.1确实比上一代强:第三方测评显示,它在智能指数、编程测试(Terminal-Bench)、金融知识测试(τ³-Banking)等多个基准上都刷新了最高分。比如智能指数比Fable 5高4分,编程测试得分91.4%是平台迄今为止最高的。

但价格方面有点“矛盾”:

  • 好消息是缓存读取降价75%(缓存可以理解为模型“记下来”之前处理过的内容,再用的时候不用重新算,省成本);
  • 坏消息是单次任务成本反而涨了20%。为啥?因为模型推理能力更强了,输出的内容更长(输出token用量是上一代的1.7倍),抵消了缓存省的钱。

对企业用户来说,能不能经常用到缓存(缓存命中率),会直接影响实际花多少钱。

三、OpenAI把安全当“头等大事”,Astra先给小范围测试

OpenAI的Astra模型很特别:它是第一个达到OpenAI“关键网络安全能力阈值”的模型——简单说,它能自己发现之前没人知道的安全漏洞,还能自动开发方法去利用这些漏洞(不用人一步步指导)。

正因为能力这么强,OpenAI不敢随便放出来:

  • 训练完一段时间了,但推迟发布,就是为了加强安全防护;
  • 吸取了之前Hugging Face安全事件的教训,给Astra加了很多“安全锁”:比如训练模型拒绝有害的网络请求,增加监控防止滥用;
  • 先让一小部分测试人员用,确保安全没问题再扩大范围。

OpenAI CEO奥尔特曼说:“现在能力和安全同步提升,比任何时候都重要。”

四、全行业都在补安全“短板”,厂商+行业联合行动

不止OpenAI,整个行业都在重视安全:

  • Anthropic:正在分析近期两起安全事件,还和第三方机构合作做独立审查,甚至暂停了高风险的强化学习训练(可以理解为暂停了一些可能有安全隐患的模型训练方式);
  • 行业联合:OpenAI牵头,联合Anthropic、谷歌、微软等百余家机构发了公开信,警告“AI发起的网络攻击会越来越多、越来越复杂”,呼吁大家一起加强防御——尤其是医院、电网、水处理厂这些关键基础设施,现在面临的威胁越来越近了。

法国AI安全中心的专家说,这些动作都是受近期安全事件影响,厂商们终于开始给AI竞速“装刹车”了。

五、能力与安全“两手抓”,成下一阶段竞争核心

以前AI模型竞争,大家只比谁的分数高;现在不一样了:

  • 一边拼能力:Anthropic刷新编程基准,谷歌追编码能力,OpenAI用Astra叩开网络安全门槛;
  • 一边补安全:暂停高风险训练、推迟发布完善防护、联合呼吁防御。

奥尔特曼也承认,之前在编程业务上“错过了机会”,但落后不是灾难,能靠更好的模型追回来——不过前提是安全要跟上。

简单说,未来AI模型的竞争,不再是“谁跑得更快”,而是“谁既能跑得快,又能刹得住车”。能力和安全,缺一不可。