第一财经

阿里Max级模型将首次开源,最强模型就得闭源的规则变了

该文章尚未提供 한국어 解读,以下为中文版内容。

核心内容总结

阿里巴巴发布了参数规模达2.4万亿的新一代基座大模型Qwen3.8-Max,这是其旗舰级Max系列首次开源。该模型通过稀疏混合专家(MoE)架构实现“大参数+低延迟”,支持100万Token长上下文和多模态视觉能力,综合性能进入全球第一梯队。阿里此次从闭源转向开源,是应对DeepSeek等国产开源模型冲击的战略调整——通过开源降低开发者门槛、争夺AI Agent生态话语权,同时依托自身全栈技术(云、芯片、模型)优势,在算力成本和生态布局上形成差异化竞争力,与DeepSeek等国产力量形成“合围”,推动全球中小企业AI基建向开源生态转移。

详细拆解解读

1. 新模型:又大又聪明还不慢,技术亮点通俗说

Qwen3.8-Max的核心技术优势可以用三个关键词概括:“脑容量大”“反应快”“能看会读”。

  • 2.4万亿参数≠笨重:它用了“稀疏混合专家架构”(MoE),就像一个公司有100个专家,但每次解决问题只找最相关的10个(仅激活950亿参数),既保留了“大模型的聪明”,又避免了全参数运行的慢和贵。
  • 100万Token上下文=能读整本书:Token是模型处理文本的基本单位,100万Token大概相当于70-80万字(比如一本《三体》小说),意味着模型能记住超长内容——比如你上传一本技术手册,它能直接基于整本书回答细节问题,不用分段喂数据。
  • 多模态视觉=能看懂图片视频:之前很多大模型只能处理文字,这个模型能直接分析图片(比如识别图表数据)、视频(比如提取关键画面信息),适合做更复杂的任务(比如设计、科研分析)。

官方说它在编程、办公、科研等领域进入全球第一梯队,意思是和GPT-4、Claude 3这些顶尖模型比,性能差距不大了。

2. 商业策略大转弯:从闭源“卖API”到开源“抢生态”

这次最意外的是阿里把旗舰级Max模型开源——之前Max系列是闭源的,用户只能通过API调用(像买水一样按次付费),现在要把模型权重免费开放(相当于把配方给你,你可以自己部署)。为啥转?

  • 被逼的:开源模型抢了市场:DeepSeek的V4 Flash模型因为性能好、价格低(推理成本比同类低很多),引发了大规模调用,证明“开源+低成本”能切走闭源模型的蛋糕。闭源模型的高API定价(比如之前有些模型调用一次要几块钱)很难维持了——用户发现开源模型能自己部署,成本更低,为啥还要买贵的API?
  • 主动的:争夺AI Agent生态话语权:AI Agent是未来的趋势(比如能自主完成“写报告+查数据+改代码”的智能助手),这类应用需要灵活部署(不能依赖单一公司的API)。开源模型能让更多开发者用它做Agent,阿里就能在这个生态里占主导——就像安卓系统开源,让全球开发者都用它,谷歌就能控制生态。
  • 阿里的底气:全栈赚钱不依赖API:蔡崇信说,纯模型公司开源很难赚钱,但阿里是全栈企业(有云、芯片、应用)——就算模型免费,开发者部署模型需要云计算资源(阿里云)、芯片(平头哥),阿里照样能从这些地方赚钱。

3. 开源后的关键:“用不用得起”比“能不能用”更重要

开源不代表免费就能用——模型运行需要算力,尤其是AI Agent要反复调用(比如写代码时不断试错、查资料),推理成本会被放大。Qwen3.8-Max的优势就是成本极低:

  • 对比:每百万Token输出成本仅6美元,是行业标杆的1/8:比如之前Fable 5模型要50美元,阿里的模型成本只有它的12%。单次对话差几块钱可能无所谓,但Agent要跑几十上百次,成本差就决定了这个业务能不能赚钱。
  • 怎么做到的?软硬件协同:除了MoE架构(减少激活参数),阿里还有自己的硬件生态——平头哥的AI芯片、CPU、网卡都是自研的,阿里云的灵骏超节点能高效运行超2万亿参数模型(国内首个)。这些硬件和模型优化结合,把算力成本压到最低。
  • 反例:DeepSeek的算力短板:新闻里说DeepSeek V4 Flash因为访问量太大,服务器崩了——纯算法公司没有自己的算力基础设施,遇到流量高峰就扛不住,而阿里有云业务支撑,不会有这个问题。

4. 国产模型“合围”:阿里+DeepSeek,各补短板打组合拳

这次发布不是阿里单打独斗,而是和DeepSeek等国产开源模型形成互补:

  • 阿里:做Agent的“地基”:Qwen3.8-Max是多模态、长上下文的基座模型,适合做复杂Agent的底层支撑(比如需要处理图片、长文本的办公助手)。
  • DeepSeek:做“低成本引擎”:它的模型推理成本极低,适合做Agent的执行层(比如快速跑代码、查数据)。
  • 合力效果:给开发者全栈选择:开发者可以用阿里的基座模型搭框架,用DeepSeek的模型做具体任务,既灵活又便宜。这种组合拳能对抗国外闭源模型(比如GPT-4),让全球开发者更愿意用国产开源方案。

5. 全球影响:中国开源模型正在改变AI基建格局

中国开源模型的进步(比如推理效率、成本控制)正在让全球中小企业的AI基建转向开源:

  • 中小企业为啥选开源?:闭源模型API贵,而且依赖单一厂商(比如断网就用不了);开源模型可以自己部署在本地或多云,成本低、可控性强。
  • 头部企业也转向开源:连阿里这样的大厂都开源旗舰模型,说明开源是未来趋势——与其死守闭源利润,不如用开源占领生态,从其他环节赚钱。

这意味着全球AI生态正在从“闭源主导”向“开源为主、闭源为辅”转变,中国模型在这个过程中占据了重要位置。

总结一句话

阿里这次发布Qwen3.8-Max并开源,是用技术优势+全栈生态,在AI Agent时代抢占地盘——既和DeepSeek等国产模型一起对抗国外闭源巨头,又通过开源绑定开发者,最终从云计算、芯片等业务中获利。对普通用户来说,未来能用到更便宜、更强大的AI工具;对行业来说,中国开源模型正在成为全球AI基建的新选择。