核心内容总结
Grok 4.6版本让马斯克的AI模型成功挤入美国顶尖大模型第一梯队,能力接近OpenAI和Anthropic的旗舰产品,编程成绩甚至部分领先,且API价格更低;但它在需要连续执行的复杂长任务中仍不稳定(容易在收尾阶段掉链子)。马斯克为AI投入了数百亿美元,Grok必须持续保持领先才能让这笔投资转化为模型、应用、算力等多维度收入,避免沦为单纯的算力出租商。当前大模型竞争已从“比谁更聪明”转向“比谁能稳定完成任务且成本更低”,SpaceXAI虽拥有算力、数据、分发的互补资源,但仍需解决组织边界、企业信任、长任务可靠性等问题。
一、Grok 4.6:进了第一梯队,但还搞不定“大工程”
Grok 4.6现在的水平相当于AI界的“准一线选手”:
- 能力够硬:在综合智能榜单上和OpenAI的Sol、Anthropic的Fable 5差距只有1分左右,编程测试甚至超过Sol;
- 价格够狠:API每百万字输入只要2美元、输出6美元,比Sol的5.69美元/次任务成本便宜一半多;
- 短板明显:做复杂长任务(比如把3分钟短片扩成90分钟电影、完成多步骤编程项目)时,开头和框架都没问题,但中间容易出错、收尾不稳定。
举个例子:马斯克说要让Grok年底做一部《奥德赛》长片,Grok能搭出制片计算器(算工期、镜头数、成本),但自己都承认208天完成90分钟片“悬”——因为几千个镜头要保持人物、场景、叙事一致太难,废片和返工成本会很高。这就像你能画好单个零件,但组装成一台能稳定运行的机器还差火候。
二、马斯克的AI豪赌:几百亿砸下去,不能输
马斯克在AI上的投入堪称“下血本”:
- 烧钱速度惊人:2026年上半年SpaceX AI分部资本开支就达236亿美元,占公司总开支的86%;
- 赌的是未来:SpaceX测算AI市场有26.5万亿美元(是火箭+卫星业务的13倍),马斯克预计2026年9月AI收入会超过其他业务总和,四五年后贡献99%的公司价值;
- Grok是关键:如果Grok能一直留在第一梯队,SpaceX就能赚“模型(API/订阅)+应用(比如X里的AI功能)+算力(租GPU)”三笔钱;如果掉队,就只能当“算力房东”(租GPU给别人),几百亿投资就打水漂了。
所以马斯克要求Grok更新速度极快:从4.5到4.6只用35天,4.7(2.1万亿参数)几周后就来——靠的是“算力堆规模(122天建10万张GPU集群)+数据喂真实任务(X的实时信息、Cursor的编程数据)+工程快迭代”的组合拳。
三、大模型竞争变天:比的不是“聪明”,是“靠谱又便宜”
以前大模型比谁能力强(比如谁能答对更多题),现在头部模型能力差距只剩几个百分点,竞争焦点变成了:
- 一次交付能力:客户买的不是“模型有多聪明”,而是“能不能一次把活干完,不用返工”。比如一个模型虽然Token便宜,但做任务要重试5次,总成本反而更高;
- 成本控制:各家都在打价格战:OpenAI把部分模型降价80%,DeepSeek的Flash版本每百万Token输入只要0.14美元(比Grok还低);
- 模型分工:OpenAI搞“梯队模型”——Sol处理复杂判断、Terra做日常工作、Luna干重复活,用分工降整体成本;Anthropic靠长任务能力(比如写长文档)维持高价,但得证明值这个钱。
简单说,现在客户选模型,就像选装修队:不仅要看手艺(能力),还要看能不能按时完工(稳定)、报价是否划算(成本)。
四、SpaceXAI的牌:有好牌,但还没凑成“同花顺”
SpaceXAI的优势是手里的牌能互相“喂饭”:
- 算力牌:Colossus集群有20万张GPU,训练速度快;
- 数据牌:X给实时信息和用户反馈,Cursor给编程任务数据;
- 分发牌:X平台能直接触达亿级用户,Cursor是开发者常用工具。
但问题也很明显:
- 组织边界:特斯拉(自动驾驶、机器人)和X、Grok之间的数据共享受隐私、监管限制;
- 企业信任:企业客户关心安全、稳定性,Grok刚进第一梯队,还没建立足够信任;
- 渠道短板:没有像Google Cloud、微软Azure那样成熟的企业销售渠道,很难拿到大客户订单。
就像马斯克想让Grok拍《奥德赛》,生成短片不难,但要让几千个镜头连贯稳定地“返乡”(完成长片),还得解决不少问题。
最后一句话总结
Grok 4.6让马斯克的AI看到了希望,但要从“性价比选手”变成“商业赢家”,还得跨过“稳定完成长任务”“赢得企业信任”“打通资源闭环”这几道坎——就像奥德修斯返乡,路上还有不少风浪要闯。