虎嗅

Claude 宣布给文字打上隐形水印,你用AI 写的每个字都藏不住了

该文章尚未提供 Русский 解读,以下为中文版内容。

核心内容总结

欧盟《人工智能法案》要求生成式AI给内容加可检测标记的新规生效后,Anthropic旗下的Claude率先推出两种“隐形标记”:嵌入式文字水印和文件元数据签名,试图解决AI内容真假难辨的痛点(比如AI写的冒充原创、原创被误判AI)。但水印并非万能,存在检测局限,还引发了“降AI率”生意、学生/员工两难等新问题。最终,水印的价值不是“定罪”AI内容,而是抬高造假成本,让责任归属更清晰。

一、为啥要给AI文字加水印?解决真假难辨的老痛点

普通人最烦的两件事:一是AI写的内容冒充“手搓原创”(比如AI写的文章作者说自己熬夜写的),拿不出证据反驳;二是自己辛苦写的被质疑“用AI”,也没法证明清白。

欧盟新规直接“下硬指标”:生成式AI必须给内容加机器可读标记,违规最高罚1500万欧元或全球营业额3%。这背后是现实里的乱象:

  • 二手平台卖AI翻译的村上春树未引进新作,买家可能不知道是AI做的;
  • 《饭圈纪实》一书被质疑AI写作,作者拿出田野调查证据也难说服所有人;
  • 高校用旧检测工具误判《荷塘月色》为AI生成,闹了笑话。

水印就是想给AI内容“上身份证”:让你知道这段文字是不是从某个AI模型出来的,减少“凭感觉判断”的争议。

二、Claude的水印怎么加?两种隐形标记让AI内容“留痕”

Claude用了两种不影响阅读的方式:

1. 嵌入式文字水印:像给文字“纹隐形纹身”。生成时把信号藏在文字里(比如用词习惯、句子结构的细微规律),你看不见、读不出差别,但机器能检测到。而且复制粘贴、轻微编辑都不会掉,不管是用Claude app还是API生成的都有。

2. 文件元数据签名:针对图片(svg/png/jpg)这类文件,会加一段“防篡改的身份信息”(遵循C2PA标准),记录“这是Claude处理过的”。比如你用Claude生成一张图表,下载后文件里会带这个标记。

检测时,用户或第三方工具能查到这些标记,但技术细节还要等Anthropic发布文档。

三、水印不是“照妖镜”,这些情况它也没辙

别以为有水印就能“一锤定音”,它有不少局限:

  • 不能直接说“全是AI写的”:比如你用Claude校对自己写的文章,输出带水印,但核心内容是你原创的;
  • 改一改就可能检测不出来:文字被大幅改写、翻译再翻回来、段落太短,水印信号会散掉;
  • 旧内容或格式转换会丢标记:8月2日前的Claude模型没水印,文件截图、格式转换(比如把图片转成PDF)会抹掉元数据;
  • 没检测到不代表没AI:用其他没水印的模型(比如旧版ChatGPT)生成的内容,或者内容被洗得太干净,都查不出来。

所以检测结果最多只能说明“这段内容可能经过Claude处理”,不能直接给内容“贴AI标签”。

四、水印引发的连锁反应:学生改口语、公司出矛盾、生意新赛道

新规落地后,现实里的变化很直接:

  • 学生的“求生欲”:高校把AI率和答辩绑定(阈值15%-40%),但不同工具检测结果差20%,原创内容也会误判。学生为了过线,把论文改得像聊天记录(口语化),甚至花钱买“降AI率”服务(销量超4000件);
  • 员工的两难:公司一边培训员工用AI提高效率,一边要求交付物AI比例不能超标。员工只能把AI输出重新手动写一遍,反而更费时间;
  • “降AI率”成生意:电商、社交平台上,几十到几百元就能帮你“洗”掉AI痕迹,本质是用另一个模型改写内容,让水印信号消失。

五、水印的真正价值:不是定罪,是抬高造假成本

水印解决不了所有问题,但它的意义在于:

  • 让“顺手造假”变麻烦:批量生成AI内容的“内容农场”,现在每篇都带标记,容易被抓;出版社想把AI翻译冒充人工,得先掂量风险;
  • 未来可能“脱敏”:等标记普及后,大家可能不再怕“用AI”,反而觉得“没标记的内容更可疑”;
  • 回归核心问题:水印回答不了“谁对内容负责”。一篇文章不管用不用AI,只要有人认真核对事实、愿意担责,读者其实不介意工具。署名的意义从来都是“出了事找我”,比“是不是AI写的”更重要。

总的来说,水印不是完美方案,但它给AI内容的管理开了个头——让真假有迹可循,让责任更清晰。

(全文完)

注:文中例子均来自新闻原文,解读尽量用日常语言,避免专业术语,希望非财经/技术背景的读者也能看懂。