虎嗅

你花一块钱,巨头补贴五块六,也盖不住几千块成本黑洞

核心内容总结

作者通过两天实测腾讯WorkBuddy和阿里千问办公的AI服务,算了一笔“算力账”:发现平台看似高额的补贴,部分是模型成本差异带来的被动结果;重度用户的算力消耗远超订阅费,是平台的“亏损炸弹”;Agent成本高的核心是“记事儿”(上下文重传)和定时任务;控制成本的关键在Harness层(路径优化、任务路由);订阅制本质是“赌用户不用”,未来会转向按量计费或按结果付费,技术降本才是留住用户的核心。

一、补贴力度大?可能是模型成本差的“障眼法”

腾讯WorkBuddy补贴5.6倍、阿里千问办公补贴2.2倍,看似腾讯更舍得让利,但背后藏着模型成本的差异:

  • 腾讯用的是第三方模型Kimi K3,混合均价24元/百万Token;阿里用的是自研Qwen3.8-Max,混合均价13.2元/百万Token(便宜82%)。
  • 两个模型性能差距极小(Qwen3.8-Max71.48分,Kimi K370.68分,差0.8分),阿里用更便宜的模型达到了差不多的效果。

结论:腾讯的高补贴,一部分是因为第三方模型成本高,不是主动让利——如果用同一个模型,补贴差距不会这么大。

二、重度用户:平台最不想见的“亏损炸弹”

作者作为“定时任务+长文修订+品牌共创”的重度用户,两天消耗的算力成本外推到每月约4300元,远超订阅费(千问办公高级版158元/月):

  • 千问办公:两天烧5000+积分,每月需7-8万积分,但高级版每月最多给6.4万积分,根本不够。
  • WorkBuddy:700万Token折1500-1900积分,高级版140元买9000积分,但若重度使用,订阅档也包不住。

平台的赌局:大多数用户买了订阅但不常用(比如Microsoft 365 Copilot周活仅2-3成),但重度用户会让平台亏——这是订阅制的悖论:最愿意买高价套餐的人,消耗最多、成本最高。

三、Agent成本高在哪?不是“思考”贵,是“记事儿”贵

Agent的成本不是花在“生成新内容”上,而是花在“记住之前的事”上:

  • 上下文重传:每轮对话要把所有历史交互(系统指令、工具定义、过往对话)重新喂给模型,生成新内容仅占5%,95%都是重复输入。任务越长,“记事儿”成本越高(第30轮成本是第1轮的10倍)。
  • 定时任务是固定炸弹:作者设置的两个定时任务(每日简报+值班日报)占两天消耗的一半,每天准点烧钱,路径优化不好时成本差3倍(第一次跑简报111分钟200万Token,第二次20分钟70万Token)。

大白话:你付的钱,大部分是让AI“别忘事儿”,不是让它“想新招”。

四、Harness层:控制成本的“隐形手”

Agent的成本管控不是财务问题,是工程问题——关键在Harness层(模型之外的路径优化、任务路由):

  • 路径记忆:AI记住哪些路走不通,第二次跑任务直接绕开,成本砍三分之二。
  • 任务路由:简单活给便宜模型,复杂活上旗舰(微软CodeAct用这个把Token消耗砍了64%)。
  • 反面案例:作者遇到AI超时空转烧钱,就是Harness层没做好(没装熔断机制)。

特点:Harness层会积累数据,越用越顺(比如AI记住你要Word交付、中午交稿),是降成本的核心。

五、订阅制是赌局,未来要“按结果付费”

订阅制的本质是“赌用户不用”,但重度用户让这个模式难以为继,行业正在转向:

  • 趋势1:按量计费:像水电煤一样,用多少付多少(千问办公的积分制就是按量的“游戏化外壳”)。
  • 趋势2:按结果付费:不为Token付费,为完成的任务(比如写一篇简报、改一篇长文)付费。
  • 核心逻辑:补贴填不了成本黑洞,只有技术降本(比如把4300元/月的成本降到430元)才能留住用户。谁先做到,谁就能赢。

最后:用户的终极判断

对内容工作者/研究者:定时日报+长文修订的组合,几十元算力换成品简报,比雇实习生划算。

对企业:先装熔断机制(防止空转烧钱)再谈规模。

对重度用户:先买高级档,再备积分包——但如果补贴停了,4300元/月的账单,不是谁都能续的。

一句话总结:Agent战争的胜负,不在补贴力度,而在谁能把成本降下来。

(全文用作者实测数据支撑,避免专业术语,让普通人能看懂AI服务背后的“钱袋子”逻辑。)