虎嗅

有没有发现,Codex 的额度越来越不经用了

核心内容总结

这篇文章揭示了当前AI编程订阅服务(以OpenAI Codex为例)背后一个残酷且隐蔽的商业逻辑:虽然你付的是“固定月费”,但你实际能买到的“算力”和“工作时间”正在被厂商通过模型升级、计费规则调整等手段悄悄缩水。

简单来说,以前订阅软件像买“自助餐”,只要不浪费,你想吃多少吃多少;现在变成了“限时限量套餐”,而且餐厅老板(AI厂商)不仅随时可能减少每份菜的分量,还因为新菜(新模型)更费火(算力),导致你原本够吃一周的饭,现在半天就没了。更糟糕的是,这种“缩水”往往不直接写在账单上,而是藏在复杂的算法和模糊的进度条里,让用户在不知不觉中多花钱,甚至面临“加钱都买不到额度”的困境。

---

深度拆解:为什么你的AI订阅越来越“不经用”?

为了让大家彻底看懂这背后的门道,我们将这一现象拆解为以下五个方面进行详细解读:

1. “隐形缩水”:模型变强了,你的钱却变“薄”了

很多用户发现,明明订阅档位没变,为什么以前能跑完的项目,现在跑一半就没额度了?这并非错觉,而是模型进化带来的“算力通胀”。

  • 以前的逻辑:老模型(如早期的GPT-4或Sol)处理任务时,思考路径短,调用工具少,像是一个“直来直去”的工人,干活快,耗料少。
  • 现在的逻辑:新模型(如GPT-5.6 Sol或Astra)变得更聪明,但也更“啰嗦”。为了给出更精准的答案,它会进行更长的推理链,反复调用各种工具进行验证。这就好比工人从“直接动手”变成了“先画图纸、再找材料、再试做、再修改”,每一步都在消耗你的“燃料”(Token/额度)。
  • 结果:官方宣称“续航延长18%”可能只是指单次任务的效率提升,但如果你把整个工作流看作一个整体,由于单次任务消耗的“燃料”大幅增加,你原本一周的“油箱”现在可能只够跑三天。这就是为什么用户感觉额度“变小”了——不是数字变了,是单位价格的含金量变了。

2. 计费迷雾:你看到的“百分比”,其实是厂商的“黑箱”

文章提到一个关键痛点:用户无法准确知道自己到底用了多少钱,只能看到一个模糊的进度条。

  • 进度条的欺骗性:OpenAI等厂商只显示“已使用百分比”,而不显示具体消耗了多少Token或折算成多少钱。这就好比加油站的油表只告诉你“还剩半箱”,却不告诉你这半箱油是92号还是98号,甚至不告诉你油箱是不是被偷偷缩小了。
  • 第三方工具的兴起:像NerfTrack这样的工具之所以流行,是因为用户想通过换算来验证自己的猜测。但即便如此,由于官方不公开具体的计费公式(比如不同模型、不同工具调用的权重系数),用户依然无法精确计算。
  • 模糊即权力:这种计费的模糊性,给了厂商极大的操作空间。当用户抱怨“额度变少”时,厂商可以辩称是“消耗变快”(因为模型更复杂),而不是“额度被砍”。这种定义权的垄断,让用户在维权时处于绝对劣势。

3. 商业算盘:订阅制背后的“亏损临界点”与“用户筛选”

为什么厂商要这么做?因为AI算力成本极高,而订阅费相对固定,这中间存在巨大的利润剪刀差,甚至亏损风险。

  • SemiAnalysis的账本:研究机构算了一笔账,当用户的使用率超过一定阈值(如Plus档超过11.4%)时,OpenAI就开始亏钱。这意味着,这套定价模式从设计之初就假设了“大多数人用不满”。
  • 筛选重度用户:对于像作者这样每天高强度使用AI写代码的“重度用户”,厂商其实是在“亏本赚吆喝”或者通过限制额度来迫使他们升级更贵的档位。
  • 动态调整策略:
  • 降价陷阱:四月Business套餐降价,看似利好,实则同步缩减了额度,实际性价比可能并未提升。
  • 限购与暂停:九月Pro 20X暂停新订阅,理由是“算力不够”,实则是为了控制成本,防止高价值用户挤占资源。
  • 结论:厂商正在通过动态调整额度、限制特定功能、暂停高配服务等手段,将算力成本的风险转嫁给用户,或者通过筛选出愿意支付更高价格的用户来维持盈利。

4. 规则突变:从“无限畅饮”到“按秒计费”的体验断层

文章对比了手机流量、软件订阅和AI订阅的区别,指出了AI订阅在用户体验上的巨大倒退。

  • 传统订阅的确定性:
  • 手机流量:10GB就是10GB,用完了就停机,规则清晰。
  • 软件订阅:买一年就是365天,不限次数,规则稳定。
  • 微信读书:月费固定,看多少本随你,规则简单。
  • AI订阅的不确定性:
  • Fast Mode的陷阱:速度快1.5倍,消耗却是2.5倍。这就像高速公路收费,你开得越快,过路费涨得越离谱,而且没有上限。
  • 规则朝令夕改:七月取消五小时限额,八月又恢复;四月降价,额度却缩水。这种缺乏契约精神的做法,让用户无法规划自己的工作节奏。
  • 心理落差:用户习惯了“订阅即拥有”的心理预期,现在却发现自己像是在玩一个“打怪升级”的游戏,不仅要打怪(写代码),还要时刻盯着血条(额度),一旦血条空了,工作就得停。这种焦虑感是传统软件订阅所没有的。

5. 用户困境:被“绑架”的开发者与多平台“游击战”

最后,文章点出了当前开发者的真实处境:离不开AI,但又被AI厂商“拿捏”。

  • 技术依赖:现在离开AI Agent,很多开发者根本写不出高效的代码。AI已经从“辅助工具”变成了“核心生产力”。这种依赖性,使得用户在面对厂商的不合理规则时,缺乏议价能力。
  • 无奈的应对策略:
  • 多平台配置:既然一家靠不住,那就多家备胎。作者提到自己配置了好多家模型的Token Plan,什么场景用哪个,能做完工作就行。这是一种典型的“去中心化”生存策略。
  • 成本对比:虽然各家都在“缩水”,但相比请一个人类程序员,AI的成本依然低得多。所以,用户只能接受这种“被剥削”的现状,在几家厂商之间来回切换,寻找性价比最高的组合。
  • 未来展望:随着AI能力的进一步普及,这种“订阅制+动态额度”的模式可能会成为行业标配。用户需要学会像管理“浮动汇率”一样管理自己的AI预算,不再期待“固定价格”,而是接受“浮动价值”。

---

给普通用户的建议

1. 不要只看月费,要看“单位算力价格”:在订阅前,尽量了解该模型在不同任务下的Token消耗率。如果可能,先用免费额度或低价档测试一下你的典型工作流,看看一周能消耗多少。

2. 建立“多平台”备份:不要把所有鸡蛋放在一个篮子里。至少准备2-3家不同厂商的AI服务,当一家额度紧张或规则变动时,可以迅速切换。

3. 关注社区反馈:像OpenAI社区、GitHub上的NerfTrack工具、以及各类开发者论坛,是发现“隐性缩水”的最快途径。官方公告往往滞后且模糊,社区用户的实测数据更真实。

4. 调整预期:接受AI订阅不是“无限畅饮”的事实。把它看作一种“按用量计费的云服务”,而不是传统的“软件许可证”。合理规划任务,避免在额度紧张时进行大规模重构,尽量在额度充足时完成核心工作。

总之,AI时代的“订阅”,本质上是一场算力成本的博弈。厂商在追求利润最大化,用户在追求效率最大化。在这场博弈中,保持清醒、灵活应对,才是普通开发者的生存之道。