一、核心内容快速总结
最近科技圈爆出的大新闻是:OpenAI用未公开的内部在研大模型,靠1万个AI智能体协作,仅花88小时就攻克了困扰全球数学界90年的「纳维-斯托克斯方程存在性与光滑性」——也就是千禧年七大顶级数学难题之一,整个过程消耗了相当于千万本普通书籍的文字计算量,后续又用数学界公认的自动验证工具花17小时做完了合规校验。
但这篇文章的核心根本不是吹AI数学有多强,而是顺着这个事件层层深挖了三个普通人也绕不开的问题:
1. OpenAI做这件事根本不是为了推动数学发展,纯粹是跟头号竞争对手Anthropic秀肌肉、比谁的模型能力更强;
2. 大家第一反应的「数学家要失业」其实想浅了,AI暴力解题的模式,甚至可能直接把人类传承了几千年的数学学科搞出断代;
3. 这件事本质上是个预警:当AI的能力已经跑到人类理解力的前面,未来AI造的飞机、AI设计的核电站、AI研发的新药,我们根本看不懂它的底层逻辑,真的敢放心用吗?这场大模型巨头的军备竞赛,已经悄无声息闯过了一个所有人都没做好准备的临界点。
---
二、分点通俗解读
1. 先给吃瓜群众算笔账:OpenAI这次干的事到底有多离谱?
很多人对新闻里的数字没概念,翻译成大白话你就懂了:
- 1万个并发智能体=同时拉了1万个各有分工的AI数学家,有人负责想思路、有人负责验算、有人负责找漏洞,全程不用休息;
- 270万条消息=这1万个AI互相讨论思路、反驳漏洞、对齐结论的聊天记录,相当于把一个顶级数学研究所几百年的内部讨论量几天内跑完了;
- 1300亿输出token≈1000万本普通厚度的书的全部文字量,相当于把人类有史以来所有数学相关的论文、教材、笔记全部反复啃了几十遍,暴力穷举了无数人类根本想不到的解题路径。
最讽刺的是,这件事从头到尾OpenAI的目标根本不是搞数学研究,就像两个手机厂商比拼谁先做出能登月的功能,根本不是为了登月,只是为了向全世界证明「我的技术比对手强得多,你们都来用我的产品、给我投钱」,结果随手秀肌肉的副产品,就把人类顶尖智力花了90年没啃下来的硬骨头给啃下来了。
2. 「数学家要失业」是伪命题,真正的损失是人类丢了「探索的爽点」
很多人看完第一反应是以后数学家都没用了,其实完全想反了:人类花几百年解数学难题,根本不是只为了拿到「这个题解出来了」的结果。
比如当年人类花300多年解费马大定理,中间为了啃这个题,数学家们前赴后继发明了十几种全新的数学工具,甚至直接开辟了好几个之前根本不存在的数学分支,这些新工具后来变成了密码学、计算机科学的基础,价值比解出费马大定理本身大一万倍。而且对数学家来说,顺着逻辑一步步推导出结论、感受到那种简洁优雅的「数学之美」,本身就是最大的乐趣。
但AI现在的解题模式相当于什么?相当于你为了开一把锁,花了好几年时间研究锁的结构、想造一把万能钥匙,结果AI上来直接用蛮力哐哐哐把锁砸开了,你根本不知道它用了什么路径,既没拿到那把能开一万把锁的万能钥匙,也完全感受不到解谜的乐趣,最后只拿到一句「锁开了」的结果,这种解题对人类数学发展的价值,其实非常有限。
3. 最可怕的后果:数学学科要出现「人类接不上的断裂带」
顺着AI暴力解题的模式往下推,很快会出现一个所有人都没预料到的问题:数学知识的代际断裂。
你想啊,如果接下来OpenAI和Anthropic继续往这个方向堆算力,可能AI一天就能解出10个之前人类几百年解不出来的顶级难题,扔出来10份证明。人类数学家就算不吃不喝不睡觉,花一整年时间啃一份证明,一辈子最多也就能看完100份,更别说很多AI推导出来的逻辑跳度极大,就像把智能手机的源代码扔给清朝最顶尖的学者,他就算再聪明也根本看不懂。
最后就会变成一个非常荒诞的局面:AI掌握了海量人类根本理解不了的数学知识,人类站在自己造出来的知识宝库门口,却根本找不到开门的钥匙,几千年一代代数学家传下来的逻辑链条直接在这一代断了,后面的学者根本没法站在前人的肩膀上继续往前走,相当于人类直接把「探索最底层知识的主动权」拱手让给了AI。
4. 「AI造的飞机你敢坐吗」不是科幻,是马上要面对的现实问题
文章里的这个思想实验,根本不是杞人忧天:现在我们坐的民航飞机,每一行控制代码、每一个零件的设计逻辑,人类工程师全都是门儿清的,出了任何问题顺着根就能找到bug在哪,绝对不会有你看不懂的隐含逻辑。
但如果是AI完全自主设计制造的飞机,它的设计逻辑里可能藏了几千个人类根本摸不透的隐含判断,你连它为什么要这么设计都搞不懂,怎么敢保证它没有藏着致命bug?你说让AI自己做安全测试?那AI的测试逻辑本身人类也看不懂,它要是故意瞒了你几个漏洞,你根本不可能发现。
现在我们日常用的AI,无非是写文案、做图、聊天,错了大不了改一遍,没什么实质性损失。可一旦AI开始进入性命攸关的场景:设计核电站、研发新药、调度城市电网、控制自动驾驶的全路网,只要出一点错就是成千上万条人命的损失,你连它的底层逻辑都看不懂,根本没有办法做任何安全校验。
5. 这件事的本质:大模型军备竞赛已经闯过了没人设防的临界点
之前行业里大家聊大模型的「 scaling law( scaling法则)」,也就是堆算力堆参数就能提升能力,最多觉得就是写代码、做内容的效率更高,没人想到堆资源居然能直接摸到人类最顶尖的智力活动天花板,甚至反过来碾压人类的最高智力水平。
接下来OpenAI和Anthropic这俩头部巨头,为了抢市场、抢估值、抢行业话语权,肯定会往死里往这个方向砸钱砸算力,你根本不知道他们下一次秀肌肉拿出来的是什么成果:可能是一份人类完全看不懂的癌症新药配方,可能是一套颠覆所有现有物理理论的新模型,这些远超人类理解能力的「黑科技」扔到社会上,我们现在的法律、伦理、安全规则全都是空白的,相当于两个小孩比赛扔鞭炮,结果不小心点着了原子弹的引信,周围的普通人根本没反应过来要躲。之前大家总觉得AI威胁人类是几十年后的科幻故事,现在看来,留给我们补安全规则、定监管边界的时间,比所有人想象的都要短得多。