虎嗅

Anthropic 突发Sonnet5,但大家更期待Fable5和Mythos5明天解禁

该文章尚未提供 한국어 解读,以下为中文版内容。

核心内容总结

昨夜Anthropic突然发布Claude Sonnet 5,它的核心是把原本只有高端昂贵的Opus模型才有的“智能体能力”(比如自己规划任务、用浏览器查资料、终端写代码等)下放到更便宜的Sonnet系列。Sonnet 5性能接近Opus 4.8,但价格低一半左右,还比前代更安全。不过用户反馈平淡,有人觉得它只是过渡产品,没有明显突破。Anthropic推出它主要是应对高端模型受限、竞争加剧等压力,用“性价比”稳住市场。

1. Sonnet 5的王牌:把高端能力“降维”卖,性价比拉满

Sonnet 5最关键的变化是“能力下放”——以前只有最贵的Opus模型能做的“智能体任务”(比如自己制定计划、调用浏览器查信息、用终端执行代码、完成多步骤工作流),现在Sonnet 5也能做了,而且价格便宜很多。

举个例子:Opus 4.8每百万字符输入要5美元、输出25美元,而Sonnet 5限时价是输入2美元、输出10美元(之后恢复到3和15),相当于打了4折。对开发者来说,不用再纠结“用贵的大模型还是弱的小模型”,可以通过调节“努力程度”(比如模型投入的资源)来平衡成本和效果;对企业来说,大部分日常复杂任务不用再花高价用Opus,用Sonnet 5就能搞定,省钱又实用。

2. 安全表现:进步但仍有“小遗憾”

Sonnet 5比前代Sonnet 4.6更安全:它更会拒绝恶意请求(比如有人让它写病毒)、不容易被“骗”(抗提示注入攻击,就是不让坏人用特殊指令劫持模型)、瞎编信息的概率(幻觉率)也更低。

但它和更高级的Opus 4.8、Mythos 5比还有差距:比如行为偶尔不一致(同样的问题可能给出不同答案);网络安全方面没专门训练,所以默认开了防护(阻止开发软件漏洞等危险操作),但防护强度比Fable 5弱(Fable会阻止更多网络安全任务)。

3. 用户反馈:平淡,没“眼前一亮”的感觉

Sonnet 5上线后,用户反应没有之前版本热烈:

  • 有人说它是“未来版本的垫脚石”,现在不用急着用(比如Reddit用户觉得它只是换了新底座,后续微调的5.x版本会更好);
  • 有人测试在自己的SaaS业务流程里表现不错,但仅限特定场景(不是通用都好);
  • 还有人吐槽它“上下文承载能力不足”(处理不了太长的复杂内容),推理能力不如Opus 4.8,甚至怀疑它是否比更便宜的Haiku 4.5值得用。

整体来看,用户没感受到像Sonnet 3.5或4.6那样的“代际跃迁”,觉得它只是“还行”,不是“必须用”。

4. Anthropic的“补位”逻辑:应对多重压力

Sonnet 5更像Anthropic的“应急补位”产品,因为最近它遇到不少麻烦:

  • 高端模型受限:6月Fable 5和Mythos 5因美国出口管制被暂停访问,刚解禁但仍有不确定性(未来可能再被限制);
  • 竞争加剧:所有头部厂商都在做“智能体能力”,Anthropic之前的“安全”“代码强”优势被追平;
  • 合规纠纷:和阿里巴巴闹矛盾(指控阿里用2.5万个假账号抽Claude数据),同时用户绕过地区限制、账号转售等问题也让它头疼。

Sonnet 5的出现,就是用“接近Opus的能力+更低价格”稳住开发者和企业,证明即使高端模型受限,Claude还有好用又便宜的选择。

5. 行业竞争新方向:从“比谁更强”到“比谁更会算账”

以前AI模型竞争是“比谁的能力更强”,现在Anthropic把竞争引到“努力程度+成本曲线”:同一个任务,你可以让模型用少点资源(低成本,效果稍弱),或者多点资源(效果好但贵)。

这对开发者和企业来说更实用——不是所有任务都值得花高价用最顶级模型,大部分时候“用合适的成本完成任务”更重要。这可能成为未来AI模型竞争的新趋势:不再只拼技术,还要拼“如何让用户花最少的钱办最多的事”。

总的来说,Sonnet 5不是“革命性突破”,而是Anthropic在压力下的“务实选择”——用性价比补位,稳住基本盘。它是否真的好用,还得看更多用户在真实场景中的测试结果。但它的发布也标志着AI模型竞争进入了“精细化算账”的阶段。