财经新闻深度拆解:AI大模型“内卷”下半场,中国模型靠“性价比”逆袭
核心内容总结
过去两周,全球AI大模型行业进入了“周更”的极速迭代期。虽然从纯技术能力榜单来看,海外巨头(如Anthropic、OpenAI、Meta)依然占据前五,但市场格局发生了微妙而巨大的反转:中国大模型在开发者实际调用量上已连续20周超越美国,占据OpenRouter平台70%以上的份额。
这一现象的核心逻辑在于行业关注点的转移:从单纯追求“最强能力”转向追求“Token ROI”(投入产出比)。对于绝大多数日常开发和应用场景,中国模型以仅为海外旗舰模型10%-20%的价格,提供了足够胜任的性能。这种“够用且便宜”的特性,让中国模型成为了企业和开发者“用脚投票”的首选,尤其是在AI大规模落地到业务流程中,成本敏感度急剧上升的背景下。
---
详细解读
1. 速度狂飙:大模型更新从“年更”变“周更”,开发者跟不上节奏
以前我们觉得大模型升级是个慢工出细活的过程,可能半年或一年才有一次大版本更新。但最近两周(9月1日-11日),海内外7家头部厂商密集发布了新模型,包括Anthropic的Claude Fable 5.1、OpenAI的GPT-6 Astra、谷歌的Gemini 3.8 Flash,以及国内的千问、DeepSeek、Kimi等。
这意味着什么?
这意味着AI竞争已经进入了“军备竞赛”的白热化阶段。模型的迭代速度甚至快过了开发者评估和切换工作流的速度。以前开发者选一个模型,可能会用半年;现在可能这个月刚调好接口,下个月就有更便宜、更快的新模型出来。这种高频迭代给行业带来了巨大的不确定性,也迫使用户必须保持极高的敏感度,随时准备切换工具以获取最优解。
2. 榜单迷雾:能力榜“海外霸榜” vs 调用量“中国主导”
这里有一个非常有趣的反差,也是理解当前AI市场的关键:
- 看能力(智商测试): 在衡量模型智力水平的榜单上,前五名全是海外模型。Anthropic的Claude Fable 5.1排第一,OpenAI的GPT-6 Astra排第二。中国最好的智谱GLM-5.3排第七,Kimi K3排第九。这说明在解决最复杂、最顶尖的逻辑推理、代码生成等“硬骨头”任务时,海外模型依然有技术壁垒。
- 看用量(真金白银): 在实际使用的API聚合平台OpenRouter上,中国模型的周调用量连续20周超过美国。在前十名的调用量榜单中,中国模型占了7个席位,总占比超过70%。一年前,这个榜单前十里只有2个中国模型,现在几乎被中国模型“屠榜”。
为什么会出现这种“能不强但用得多”的局面?
因为大多数人的工作不需要“最强”的模型,只需要“够用”的模型。就像买车,虽然法拉利最快,但99%的人日常通勤买一辆省油、耐用的丰田或比亚迪就足够了,没必要为了那多出来的10%性能多花10倍的钱。中国模型精准地切入了这个“够用”的市场。
3. 核心逻辑:从“拼智商”到“拼性价比”,Token ROI成为新关键词
瑞银证券的分析师指出,2026年下半年,行业讨论的焦点从“Token-maxxing”(尽可能多用AI)变成了“Token ROI”(Token的投入产出比)。
通俗解释:
- 上半年: 很多公司鼓励员工无限制使用AI,觉得用得越多越先进,结果账单爆炸,且很难算清楚这些AI到底帮公司赚了多少钱。
- 下半年: 老板们开始算账了。他们发现,对于写普通代码、处理文档、做简单数据分析等日常任务,用昂贵的海外旗舰模型是“杀鸡用牛刀”。于是,大家开始追求“Token Optimization”(Token优化),即在保证质量的前提下,尽可能降低每次调用的成本。
中国模型的优势:
国内主流模型的API价格大约只有国际同行的10%到20%。例如,DeepSeek V4.1 Flash的成本极低,部分任务成本甚至只有顶级模型的1/37到1/76。对于初创公司或大规模部署AI的企业来说,这种成本差异是生死攸关的。用海外模型可能“烧光风投资金”,而用中国模型则能实现规模化落地。
4. 真实案例:开发者“用脚投票”,工作流全面切换
新闻中提到的开源项目xiaobei的开发者经历非常有代表性。
- 年初: 他还在用昂贵的Claude作为核心工作模型,只有简单任务才用国产模型。
- 5月起: 他的工作流全部切换为国产模型(智谱GLM 5.3、阿里千问、DeepSeek V4.1 Flash)。
- 原因: 他坦言,“99.99%的编程任务对于现在GLM 5.3这一档的模型来说,都称不上是较难的任务。”除非是开发操作系统内核、渲染引擎等极复杂的底层任务,否则没必要为顶尖模型支付数十倍的成本。
市场趋势:
越来越多的全球领先IT企业也开始将中国开源模型纳入实际工作流。这不是因为中国模型在技术上全面超越了海外,而是因为它们在价格、速度、稳定性上达到了一个极佳的平衡点。对于大多数应用场景,这个平衡点就是“最优解”。
5. 深层洞察:低价不是“贴钱换量”,而是技术效率的胜利
很多人会问:中国模型这么便宜,是不是在亏本卖?是不是不可持续?
瑞银的调研给出了否定的答案。中国模型厂商的API业务毛利率大多在20%-40%之间,并没有“贴钱”扩大市场。
这意味着什么?
这说明中国厂商通过模型架构创新、优化训练和推理效率,真正降低了成本。他们不是靠补贴,而是靠技术效率赢得了竞争力。DeepSeek V4.1 Flash上线24小时处理1万亿Token,48小时有望达2.8万亿,这种极高的吞吐量和极低的单位成本,是技术实力的体现。
结论:
中国模型并没有赢下“技术巅峰”的战争,但已经赢下了“大规模应用”的市场。它们通过极致的性价比,成为了AI落地过程中的“默认入口”。未来,随着AI从“尝鲜”进入“日常”,这种对成本敏感的市场份额只会进一步扩大。海外模型将继续占据“高精尖”的小众市场,而中国模型将主导“广覆盖”的大众市场。