虎嗅

三年内,AI 控制会走向安全的一线

该文章尚未提供 Русский 解读,以下为中文版内容。

核心内容总结

这篇文章的核心观点是:AI正从“能力扩张”阶段转向“控制约束”阶段。现在大家都在关注AI能做什么(比如写代码、处理文档),但随着AI agent(能直接执行任务的AI)的出现,AI不再只是“说”而是“做”,安全风险从内容错误升级到实际行动的危害。未来AI发展的关键不是让它更强大,而是建立一套系统化的控制机制,明确它能做什么、不能做什么,这样AI才能安全地进入企业核心系统、金融等关键场景。

拆解解读

1. AI的“成长烦恼”:从“炫技”到“守规矩”

现在社会对AI的期待还是“多做事”——让它写代码、当客服、处理数据,就像蒸汽机刚出来时大家关心它能带动多少机器,电力刚普及大家关心它能点亮多少城市。但所有技术发展到一定阶段,都会从“能做什么”变成“该做什么”。比如汽车刚出现时大家只看速度,后来必须有交通规则、红绿灯;飞机刚上天时大家只关注能不能飞,后来必须有空管和航线。AI现在就到了这个转折点:光有能力不够,得给它立规矩。

2. AI agent让风险“落地”:从“动口”到“动手”

以前的AI像个“顾问”——回答问题、生成内容,错了改改就行。但AI agent不一样,它能直接操作真实系统:比如调用支付接口转账、部署代码到生产环境、修改企业数据库。这就像以前你问朋友“要不要转账”,朋友给建议;现在朋友直接拿你手机转了——风险从“信息错误”变成“实际损失”。所以问题不再是“AI能不能做”,而是“AI有没有资格做”。

3. AI安全变了:从“内容对不对”到“行为该不该”

现在大家谈AI安全,还停留在“有没有幻觉”“会不会输出错误信息”。但未来的安全重点是“行为控制”:比如AI能生成代码,但能不能直接部署?能分析付款合理性,但能不能直接发起转账?能读数据,但能不能删日志?这些动作一旦出错,就是真金白银的损失或系统崩溃。同一个AI,做不同的事风险天差地别,必须给它划清“能做”和“不能做”的线。

4. 传统权限不管用了:得给AI定制“红绿灯”

过去软件系统里,权限都是给人的——账号是人的,审批是人做的。但AI agent是自动执行任务的:你给它一个目标,它自己拆解步骤操作。这时候光看账号权限就没用了,得问:这个动作在这个场景下合理吗?AI懂不懂风险?如果AI被诱导了,系统能拦住吗?比如AI要转一笔巨款,不能只看账号有没有转账权限,还要看这笔钱转给谁、为什么转、有没有超过风险阈值,甚至需要人类确认。

5. 控制体系是AI的“通行证”:没有约束就进不了核心场景

AI要进入金融、企业核心系统、工业控制这些关键领域,必须有控制体系。就像没有刹车的汽车不能上路,没有空管的飞机不能飞,没有风控的金融系统不能交易。未来AI的竞争,不只是比谁的模型更聪明,更是比谁能让AI安全运行——谁能定义AI的边界,谁能让企业放心把AI接入核心业务,谁就能赢。这不是限制创新,反而是让AI真正发挥价值的前提。

一句话总结

AI越来越能干,但能干不等于可以随便干。接下来的重点是给AI立规矩、划边界,让它在安全的框架内做事,这样才能真正成为改变世界的工具。