第一财经

拥抱国产,京东云拟建设摩尔线程十万卡GPU智算集群

一、核心内容大白话总结

这则新闻说的是2026年京东云在自己的科技大会上扔了个行业重磅消息:要建一个装10万张国产GPU芯片的超级算力大集群,全部用国产厂商摩尔线程的芯片当核心算力底座,专门给大模型训练、能在现实世界干活的智能机器人/工业机械臂这类“物理AI”提供算力,直接对外开放给全行业用。

这是国内头一回头部云厂商把十万卡级别的核心智算集群全部换成国产芯片,刚好踩中了工信部“十五五”鼓励发展国产智算集群的政策风口,标志着之前大家觉得“性能一般、只能凑合用”的国产GPU,终于跨过了大规模商用的门槛,不用再被海外芯片卡脖子,接下来AI算力的成本会大幅下降,各行各业用AI的门槛也会跟着低很多。

---

二、分点详细解读

1. 先搞懂:这个十万卡国产GPU集群,到底是个什么级别的“超级工程”?

很多人对“十万卡GPU”没概念,打个比方你就懂:之前国内所有头部云厂商的十万卡级核心算力集群,用的全是海外英伟达的芯片,国产GPU之前最多只能凑几千张,能稳定跑通一万张都算行业顶尖水平。

这次直接干到10万张,难度根本不是“数量翻10倍”这么简单:相当于把10万台高性能游戏电脑连在一起同时干活,只要其中1台出故障掉线,整个大模型几个月的训练进度直接就卡壳,之前国产芯片的稳定性、互联速度根本扛不住这个要求,这次相当于直接把国产算力的性能上限拉了10倍,不是PPT上的概念,是真的能稳定跑大模型训练的实打实的超级算力池。

2. 为啥偏偏现在搞?政策和产业的“东风”刚好凑齐了

这事不是京东拍脑袋蹭热点搞的面子工程,是刚好踩中了两个关键节点:

一方面工信部刚出的“十五五”信息通信规划,明明白白鼓励大家建万卡、十万卡级别的国产智算集群,还给了各种配套支持,之前企业不敢大规模用国产芯片,怕踩坑没人兜底,现在政策直接给了明确方向;

另一方面现在能在现实世界干活的“物理AI”(比如物流机器人、工厂智能机械臂、家用服务机器人)刚好到了爆发的临界点,算力需求比之前纯线上的AI大了几十倍,之前靠进口芯片不仅价格贵得离谱,还随时可能被限制供货,京东自己手里握着零售、物流、工业几千个真实的实体场景,本身就缺这么大的算力池,完全是“自己用不完再对外开放”,根本不是摆着看的花架子。

3. 不是“买芯片凑数”,这次合作是从根上打通的全栈绑定

之前很多云厂商买国产GPU,本质就是“凑数应付国产化要求”:芯片是国产的,但是配套的云平台、大模型训练软件全是用海外的老一套,适配做得特别差,芯片的性能最多只能发挥30%,跑起来又慢又容易出问题。

这次京东云和摩尔线程是从芯片底层就开始一起合作改:芯片的参数照着京东大模型训练的需求调,云平台的配套工具专门给国产芯片量身定做,连大模型训练的流程都是两边一起磨出来的,相当于你买发动机的时候,直接让发动机厂商跟整车厂一起设计整车,性能能100%拉满,而且京东手里几千个真实产业场景的需求,还能反过来喂给芯片厂商迭代优化,越用越好用,形成“真实场景→训练模型→优化芯片”的正向循环。

4. 最实在的好处:全行业的AI算力成本要直接打下来

这个十万卡集群跑通之后,最直观的影响就是AI算力的价格会大幅跳水:之前用进口卡训练一个中等规模的大模型,光算力费就要花大几千万,现在国产芯片本身的采购成本就比进口低一半,再加上十万张卡的规模效应,整体算力价格至少能砍半。

之前小工厂、小创业公司根本用不起AI:比如开个小加工厂,想给车间的机械臂做智能调度,光算力训练费就要几十万,现在几万块就能搞定;普通人用AI生成1小时的长视频、做3D内容的成本也会大幅下降,甚至以后几千块钱就能买到能真的帮你做家务的家用服务机器人,而不是现在那种只能扫扫地的“玩具款”。

5. 行业里程碑:国产GPU终于从“凑合用”走到“敢大规模商用”

之前整个行业对国产GPU的刻板印象就是“性能差,只能跑跑简单的AI任务,不能用来训练大模型”,很多企业就算想支持国产,也怕用了之后掉链子耽误自己的业务。

这次京东十万卡集群落地,相当于给全行业做了一个“可直接抄作业”的样板:证明国产GPU不仅能稳定跑万卡级的集群,十万卡级的核心业务也完全扛得住,接下来其他云厂商、其他企业要建智算集群,根本不用再纠结选进口还是国产,直接照着这个方案落地就行,整个国产算力的产业链从芯片、服务器到云平台的生态就彻底活了,再也不用被海外厂商卡脖子。