虎嗅

互联网不是在进化,是快死了

该文章尚未提供 Deutsch 解读,以下为中文版内容。

核心内容总结

这篇文章揭示了一个扎心的现实:AI已经全面接管互联网——不仅生成的内容超过人类,连访问互联网的流量也首次被AI机器人超越。这导致互联网陷入“AI自产自销”的闭环,不仅让人类面临心理危机、信息信任崩塌,还会让AI模型因数据自我污染而逐渐失效。文章最后提出了打破闭环的办法,并预测未来互联网会分裂成“上层智慧绿洲+下层数字垃圾场”的沙漏结构。

一、AI主导的互联网闭环,让人类成了“局外人”

现在的互联网,一半以上内容是AI写的,新增网页74%带AI痕迹;更夸张的是,机器人访问流量(57.5%)已经超过人类(42.5%)。这对我们有啥影响?

  • 真假难辨的心理负担:你刷到的帖子、看到的新闻,可能都是AI编的。长期面对这种“伪造环境”,人会得“替身恐惧症”——怀疑网上的一切是不是真的,甚至不敢留真实痕迹。比如比利时那个生态学家,和AI聊天后焦虑被放大,最后自杀了。
  • 信息变成“回声壁+垃圾场”:AI生成内容靠训练数据,越用AI越容易同质化(比如都爱用“总而言之”),形成“你喜欢啥就喂你啥”的合成信息流,让人陷入焦虑抑郁。更糟的是,AI降低了虚假新闻、广告诈骗的门槛,“眼见不一定为实”成了常态。
  • 商业模式要崩:过去互联网靠“抢人类注意力”赚钱(比如广告看点击量),现在广告被机器人看了,真实人类觉得内容无聊就跑了,谷歌、Meta这些平台的饭碗都要碎。

二、AI闭环会让互联网“自我吞噬”

AI自己生产内容、自己爬取内容,就像“镜子照镜子”,最后会把自己玩死。

  • 数据递归污染:Nature论文说,AI训练数据如果全是前代AI生成的,就会失去真实世界的锚点。比如第一代AI写内容选最平庸的(概率最高的词汇),第二代再用这些数据训练,独特的人类智慧就被过滤掉,到第九代可能只会重复“斑马”这种无意义的词——就像复印件复印十次,最后变成一团黑。
  • 模型幻觉放大:AI生成内容本来就有小错误(比如编造事实),没有人类真实数据校准的话,错误会越积越多。比如中期AI会混淆因果(把假新闻当真理),晚期直接失去对现实的认知能力。
  • 信息热寂:人类每天产生真实的新信息(比如生活摩擦、灵感),但AI只能重组旧数据,无法创造新的真实内容。互联网变成封闭系统,信息最后退化成毫无意义的噪音。

三、怎么阻止互联网“死掉”?核心是打破AI闭环

要救互联网,就得把人类真实数据重新拉回来:

  • 给AI内容“打标签”:像给转基因食品标标识一样,给AI生成的内容加水印(底层代码里的数字指纹),让爬虫不爬这些内容,避免进入下一代模型训练池。现在全球30多个国家(包括中国、欧盟)都强制要求AI内容标识,微软、Meta这些公司也在做。
  • 保护人类创作者:平台要给真人创作者认证(比如“100%人类创作”标签),还要建立版权分成机制——AI用了谁的知识,就得给人家分钱,激发人类创作动力。比如Reddit、知乎可能会搞更严的实名验证。
  • 但效果有限:这些措施只能延缓死亡,因为2023年后的互联网数据已经和AI深度绑定,就像碳排放一样没法完全消除。真人创作者可能会躲进付费私域(比如Discord私密群),公共互联网慢慢变成机器人互刷的空壳。

四、未来互联网:沙漏型结构,普通人只能看“垃圾”

人类回不去没有AI的互联网了(就像汽车普及后不能退回到马车),未来互联网会分成两极:

  • 上层智慧绿洲:付费、邀请制、严格真人验证的私密空间,比如独立智库、加密社群、专业学术网络。这里的内容是真实人类生产的高质量信息,不会被AI污染。
  • 下层数字垃圾场:免费但全是AI生成的低质内容(比如SEO营销文、流水线配图),90%的活动是机器人互聊、互点赞。普通人只能在这里消费娱乐内容,思想被同质化。
  • 中间通道极窄:上层的优质内容泄露到下层,会立刻被AI拆解成平庸版本;下层的机器噪音想进上层,要过严苛的过滤器。信息阶层分化成必然——富人能买真实情报,普通人只能看AI垃圾。

最后,文章感叹:那个由真人写博客、论坛盖楼的互联网已经死了,就像天涯社区上线失败的征兆一样。未来,我们可能要为“真实信息”付费,这和互联网最初“免费共享”的初衷背道而驰。但这是AI时代不得不面对的现实。