第一财经

马斯克的Grok模型重回牌桌,不卷最强、要拼性价比

该文章尚未提供 日本語 解读,以下为中文版内容。

核心内容总结

淡出主流模型竞争两个月后,马斯克带着Grok 4.5回归,但这次他放弃了“比谁参数更强”的路线,转而主打实用性价比:用更低成本、更快速度,实现接近前沿模型的能力,瞄准企业真实生产力场景。同时,这也是SpaceX整合编程工具Cursor后的首个产品,标志着马斯克的AI业务从xAI解散后的重新出发,试图在企业工具市场找到突破口。

一、马斯克变务实了:不再争“最强模型”,改拼“好用又便宜”

过去AI公司都抢着说自己的模型是“全球第一”,但马斯克这次换了思路。他直接承认Grok 4.5不如Anthropic的Claude Fable强,但强调“大多数任务根本不需要那么顶级的能力”。比如网友测试发现,Grok 4.5用十七分之一的成本,就能达到接近Fable的效果。马斯克说,他们更关注“现实世界的实用性”——特斯拉和SpaceX的工程师觉得好用,比在测试榜上排第一更重要。

简单说,以前大家比“谁跑得最快”,现在马斯克比“谁用最少的油跑够日常需要的路”。

二、性价比到底有多香?成本砍半,速度更快,少花“文字钱”

Grok 4.5的性价比体现在三个地方:

1. 成本低:定价是每百万输入Token(可以理解为模型“读”的文字单位)2美元,输出(模型“写”的内容)6美元,比很多同类模型便宜。比如在真实职场任务测试中,Grok 4.5完成一个任务只要0.49美元,比国内的智谱GLM-5.2和Kimi K2.6都低;编程任务成本约2.5美元,是Claude Fable 5的1/5,GPT-5.5的一半。

2. 速度快:每秒能生成80个Token(TPS),比同类模型快不少,意味着用户等回复的时间更短。

3. 少用Token:完成同样任务,Grok 4.5用的文字单位更少。比如编程任务,它平均只用1.6万个输出Token,比Claude Opus 4.8少四分之三——Token用得少,成本自然更低。

用大白话讲:同样干一件事,Grok 4.5花的钱更少,速度更快,还不浪费“字数”。

三、收购Cursor补短板,Grok 4.5瞄准企业“干活工具”

以前马斯克的AI团队在编程领域有明显短板,所以今年6月SpaceX收购了编程工具Cursor。这次Grok 4.5就是整合Cursor后的第一个产品:

  • 训练时用了Cursor的数万亿真实开发数据,不仅学代码,还学开发者怎么改代码、调用工具、和AI协同——相当于把程序员的“工作经验”灌进了模型。
  • 现在Grok 4.5重点瞄准真实办公场景:Excel表格、PPT制作、Word文档,还有复杂的软件工程。

这意味着Grok不再是单纯的聊天机器人,而是变成了企业员工的“生产力助手”——帮你写代码、做报表、做PPT,直接解决实际工作问题。

四、团队大换血后重新出发,SpaceX需要AI故事

Grok的背后经历了不少动荡:2025年2月到2026年3月,xAI(马斯克之前的AI公司)的核心成员陆续出走,创始团队全走光了;今年5月,xAI被解散,Grok被整合进SpaceX,成了SpaceXAI的子产品。

Grok 4.5是SpaceXAI团队重建后的第一个产品,对马斯克来说意义重大:他需要向投资者证明,SpaceX不仅能造火箭,在AI领域也能玩得转。毕竟现在AI是科技圈的“香饽饽”,SpaceX需要更多AI故事来支撑估值和未来发展。

五、行业风向变了:从“比排名”到“比任务成本”

过去两年,AI公司都盯着测试排行榜,谁排第一谁厉害。但今年不一样了——随着模型落地到企业,大家更关心“完成一个真实任务要花多少钱”(Cost per Task)。

比如有开发者说:“现在部署AI,任务成本是唯一重要的数字。”如果一个模型能用极低的成本达到前沿能力的95%,对企业来说比“排名第一但贵得要死”的模型更有用,因为大多数企业的任务都不是最难的那种。Grok 4.5刚好踩中了这个趋势——它在性能和成本的“最优平衡点”上(专业叫帕累托前沿),对企业很有吸引力。

最后:Grok 4.5能撼动市场吗?

目前来看,Grok 4.5的性价比确实亮眼,但能不能真正改变市场格局,还得看企业和开发者买不买账。毕竟现在头部模型(比如OpenAI、Anthropic)已经占据了不少市场份额,马斯克的“实用路线”能不能突围,还要等实际使用后的反馈。不过,这次回归至少让马斯克重新回到了AI牌桌,不再是旁观者了。