虎嗅

阿里大动作,全面禁止Anthropic

该文章尚未提供 Français 解读,以下为中文版内容。

核心内容总结

阿里与AI公司Anthropic爆发了一场“罗生门”冲突:阿里先宣布全面禁用Anthropic的AI产品(如Claude),随后Anthropic反戈一击,指控阿里未经授权“窃取”其数据用于训练自家大模型(通义千问)。双方各执一词,事件真相尚未明确,但背后折射出AI行业数据竞争的激烈与敏感。

一、事件梳理:阿里禁用在先,Anthropic告状在后

事情的时间线很清晰:

1. 阿里禁用Anthropic:近期阿里内部通知,要求员工停止使用Anthropic的所有AI工具(包括Claude),理由未公开,但推测可能与数据安全、内部工具推广有关。

2. Anthropic反指控:Anthropic随后在官网发文,称发现阿里某些团队通过“异常API调用”(比如用自动化脚本批量获取数据),将Claude的对话数据、模型输出用于训练自家大模型,违反了双方的服务协议。

目前阿里暂未对指控作出详细回应,仅表示“会依法处理”。

二、双方的“理”:各说各话的背后逻辑

  • 阿里禁用的可能原因

要么是“安全考虑”——担心员工用外部AI工具时,把阿里的商业数据(比如客户信息、内部方案)泄露给Anthropic;要么是“自家优先”——阿里有自己的大模型“通义千问”,想让员工都用自家工具,推动内部生态闭环。

  • Anthropic指控的动机

数据是AI公司的“命根子”。Anthropic的Claude模型靠独特的训练数据和算法立足,若阿里真的偷了数据,等于直接抄走了它的核心竞争力。而且Anthropic刚融了大笔资金(估值超100亿美元),此时发声既能维护自身权益,也能提升行业关注度。

三、AI圈的“数据战争”:为啥偷数据这么敏感?

AI模型就像“学生”,数据是“课本”——没有高质量的课本,学生学不出好成绩。Anthropic的“课本”是它花了大量钱和时间收集、整理的对话数据(比如用户和Claude的聊天记录、专业领域文本),这些都是商业机密。

如果阿里真的通过API批量爬取Claude的数据,相当于“偷了人家的课本去教自己的学生”,这不仅违反协议,还可能侵犯知识产权。在AI行业,这种行为比普通商业竞争更严重,因为数据是模型的核心壁垒。

四、罗生门的真相猜测:两种可能的方向

目前没有确凿证据,但可以猜两种情况:

1. 阿里真的“偷”了:可能某些团队为了快速提升通义千问的能力,走了“捷径”——利用Anthropic的API批量获取数据。毕竟AI模型训练需要海量数据,自己收集成本太高,“抄近路”的诱惑很大。

2. Anthropic“借题发挥”:也许阿里只是正常使用API,但Anthropic想借这个事件抹黑阿里,或者给其他公司敲警钟(别随便用我的数据)。毕竟Anthropic和阿里在AI市场有潜在竞争(比如都做企业级AI服务),这步棋能提升自己的行业地位。

当然,也可能是双方在合作中产生了分歧(比如阿里之前用Anthropic的服务,后来想终止,Anthropic不满),才引发这场冲突。

五、对行业的影响:AI竞争会更“卷”吗?

这件事可能会让AI行业的“戒备心”更强:

  • 企业更谨慎用外部AI:以后大公司可能会限制员工使用外部AI工具,或者加强数据监控,防止自家数据泄露,也防止“被偷数据”的指控。
  • AI公司更严管API:Anthropic这类公司可能会收紧API权限,比如限制调用频率、增加数据加密,避免被批量爬取。
  • 数据规范更受关注:AI行业的“数据使用边界”会成为焦点——到底什么是“合理使用”?什么算“窃取”?可能需要更明确的法律或行业规则来界定。

总之,这场罗生门不是简单的“谁对谁错”,而是AI行业数据竞争白热化的一个缩影。最终真相可能需要双方拿出证据,或者通过法律途径解决,但无论结果如何,都将影响未来AI公司的合作与竞争方式。