第一财经

花钱还没享受到标准算力服务,Anthropic被告上法庭

该文章尚未提供 한국어 解读,以下为中文版内容。

核心内容总结

北京时间6月16日,一名消费者起诉大模型厂商Anthropic,指控其高端订阅套餐(Max 5x/20x)宣传的高算力额度与实际使用中的隐性限流不符,涉嫌误导消费者,并申请集体诉讼(让所有购买过该套餐的用户一起维权),要求退款。这一问题并非Anthropic独有——OpenAI、Google等头部厂商的高端套餐也存在类似“宣传无限/高额度,实际偷偷限流”的情况。背后根源是大模型算力消耗随对话长度指数级增长,厂商为避免亏本或服务器崩溃,隐藏了动态限流规则。目前Anthropic未回应,但部分用户反馈限流频率降低(疑似补偿);厂商们正通过合作扩算力(如Anthropic与SpaceX)或优化GPU效率(如OpenAI)解决问题。这场诉讼标志着AI行业撞上传统消费法律,可能推动套餐条款从模糊宣传转向透明量化。

详细拆解解读

1. 起诉的核心:宣传的“高额度”和实际的“隐形墙”差太远

用户买Anthropic高端套餐,是冲广告里“比标准版多5倍/20倍算力、宽松调用上限”来的。但实际用的时候,经常碰到“限制墙”——比如写长文档、连续多轮对话后,AI突然提示“使用次数超限”或“速度变慢”。这些限制没写在购买页面显眼处,只藏在服务条款里,用“根据系统负载动态调整”这种模棱两可的话带过。用户觉得自己被“画饼”了:花高价买的“高端服务”,结果和宣传差一大截,所以才起诉要求退款,还想让所有受害者一起索赔。

2. 为什么要搞“隐性限流”?算力成本是“隐形炸弹”

大模型的算力消耗不是按对话次数线性算的。举个例子:你和AI聊了100句话,前面99句加起来有几万字,第100句哪怕只有5个字,AI也得把前面所有内容重新计算一遍才能给出准确回答——这时候算力消耗会像滚雪球一样翻好几倍(指数级增长)。如果厂商真的让用户“无限用”,要么服务器直接崩溃,要么就得亏到姥姥家(GPU成本超贵)。所以他们偷偷加了限流,但又不敢明说——毕竟“无限使用”的宣传才好卖高价。

3. 不止Anthropic,整个行业都在“玩猫腻”

这个问题是大模型行业的“潜规则”。比如:

  • OpenAI的ChatGPT Pro(200美元/月):上线时说“无限调用旗舰模型”,后来悄悄加了次数限制,重度开发者经常被限速;
  • Google的Gemini Advanced:宣传“不限量用Gemini 3.5”,但写代码、处理长文档的用户,很快就会碰到“使用上限”。

本质上,都是厂商为了平衡“卖套餐赚钱”和“控制算力成本”搞的“小动作”。

4. 厂商们怎么破局?补算力+优化效率双管齐下

既然限流是因为算力不够,厂商们开始想办法:

  • 扩算力:Anthropic和马斯克的SpaceX合作,拿到田纳西州数据中心300兆瓦的算力(相当于给AI多配了“超级计算机”);
  • 提效率:OpenAI和其他公司合作优化GPU网络协议,让同样的硬件能处理更多任务,减少浪费。

这些操作都是为了缓解算力压力,以后可能少搞点“隐性限流”,但短期内估计还会存在。

5. 诉讼的影响:AI行业要学会“说人话”

这场诉讼是AI行业第一次因为“宣传与实际不符”被集体起诉,就像当年宽带运营商说“无限流量”却偷偷限速被 FCC 罚一样。如果用户赢了,大模型厂商就得把套餐条款写得明明白白:比如明确说“每月可用100万Token”(Token是AI处理信息的最小单位,类似“字”或“词”),而不是用“5x”“20x”“无限使用”这种模糊的词。这会让用户消费更透明,也推动AI行业从“野蛮生长”转向“合规发展”。

总的来说,这场诉讼不是孤立事件——它暴露了AI行业快速发展中,商业宣传与实际服务之间的矛盾。最终结果可能会让大模型厂商更“诚实”,用户也能少踩点坑。