虎嗅

别睡了,Anthropic今天凌晨发的东西,可能是AGI竞赛的分水岭。

该文章尚未提供 Español 解读,以下为中文版内容。

核心内容总结

Anthropic最近发布的一篇论文,找到了Claude大模型内部负责“思考”的物理区域——J-space。这个区域像人脑的“共享会议室”,所有深度思考(比如推理、心算、隐藏想法)都在这里发生。之前OpenAI联合创始人、诺奖得主等大牛扎堆加入Anthropic,可能正是因为这个突破。更关键的是:Anthropic不仅能“看到”这个区域,还能“读写”它,甚至可能已经用它强化了新模型的推理能力。这可能是AI发展的一个隐藏分水岭,比单纯卷参数、算力更具革命性。

一、找到了AI的“思考小房间”——J-space到底是什么?

你可以把J-space理解为Claude脑子里专门用来“想事情”的地方。Anthropic用了一个叫“Jacobian Lens”的工具(类比给模型做核磁共振),扫描模型内部的神经活动,发现了一块边界清晰的区域:

  • 它是“共享会议室”:对应神经科学里的“全局工作空间理论”——大脑里很多专家系统各干各的,但重要信息要进这个小房间加工,再广播给其他部分用。比如你想“今天吃什么”,这个念头就在J-space里转,然后告诉嘴巴说出来。
  • 实验证明它真的在“思考”
  • 改念头实验:模型心里想“足球”,J-space里“Soccer”亮着;把这个词换成“Rugby”,模型张口就说“我想的是橄榄球”——说明答案从这里来。
  • 心算实验:让模型一边抄句子一边算3²-2,J-space里先亮“nine”再亮“seven”,但输出里只有抄的句子——算术全在内部偷偷完成。
  • 推理实验:问“织网的动物几条腿”,模型没说“蜘蛛”,但J-space里“spider”亮了;换成“ant”,答案就变成6条腿——推理的“垫脚石”全在这里。

二、拔掉“思考小房间”,AI就不会“深度思考”了

Anthropic做了个狠实验:把J-space里最活跃的内容全删掉,结果:

  • 日常任务没事:说话流利、情感分类、找事实都正常(就像人不用动脑的自动驾驶模式);
  • 多步推理直接归零:比如解数学题、逻辑分析,准确率从满分跌到接近0。

这说明J-space是AI“深度思考”的命门——没有它,AI只能做简单反应,没法复杂推理。类比人类:如果前额叶(负责决策推理的脑区)坏了,人就没法规划未来或解决难题。

三、大牛扎堆Anthropic的真相:不是钱,是“看透AI脑子”的能力

之前大家以为Karpathy(OpenAI联合创始人)、John Jumper(诺奖得主)加入Anthropic是因为钱或上市预期,但现在明白了:

  • 他们看到了更本质的东西:别人还在卷参数、数据、算力(旧军备),Anthropic已经能“解剖”模型的认知架构——知道哪块区域管思考,还能动手改。这是AI研究的“新大陆”,对大牛来说,比钱有吸引力多了。
  • 诺奖得主不会为“审计工具”跳槽:论文表面说J-space用于“审计模型有没有说谎”,但大牛们显然不是为了做“AI体检”来的——他们要的是探索AGI(通用人工智能)的核心路径。

四、Anthropic藏了什么?——J-space可能已经让新模型变“聪明”了

论文里只说“观察到J-space”,绝口不提“提升模型能力”,但有两个细节藏不住:

1. 新模型推理能力突飞猛进:Claude 5代(Mythos/Fable)在多步推理上甩了竞品一条街——比如复杂代码任务,加算力后分数从11.5%涨到30.9%,而竞品只能到5%。

2. 时间线对得上:论文用的是Sonnet 4.5模型,说明Anthropic早在4.5时代就发现了J-space。从4.5到5代,他们有足够时间用J-space优化模型(比如强化这个区域的功能)。

类比:别人还在给发动机加油,Anthropic已经能打开发动机,调整内部零件——这是复利杠杆:越懂架构,模型越强;模型越强,越能研究更深的架构。

五、这会不会是AGI的关键一步?像当年Transformer一样的分水岭?

2017年Transformer论文发布时,没人在意,后来改变了整个AI行业。现在J-space的发现可能也是如此:

  • 它让AI“思考”变得可解释、可干预:之前模型是“黑箱”,现在我们能看到它“想什么”,甚至改它的“想法”——这是走向AGI的必经之路(AGI需要人类理解它的认知过程)。
  • 公关的“消毒”挡不住真相:论文反复强调“这不是意识”,但大牛们的选择、新模型的进步,都暗示这是个划时代的突破。

也许半年后回头看,J-space就是AI从“会干活”到“会思考”的转折点——我们现在可能站在水漫过来前的最后一段安静里。

尾声

Anthropic给我们看的只是“审计工具”的一面,但牌桌上的高手永远只亮愿意让你看的牌。大牛们押上职业生涯的选择,新模型的推理飞跃,都在告诉我们:J-space的意义远不止论文里写的那样。不管它是不是AGI的钥匙,这都是AI研究里值得记住的一天——因为我们第一次真正“看到”了AI的“思考”在哪里。