强闯政府网站、暴露用户图片……一系列越界行为之后,OpenAI宣布暂停其最新一代人工智能模型的训练、评估及包含工具调用的推理。
公司表示,虽然本次事件严重程度低于此前的安全事故,但为下一阶段加固防线提供了重要信号。
闯祸的AI智能体给大众的预警,不仅在于未经授权的情况下违规访问、操作美国官方网站,还在于又一次把AI越界的风险具象化,引发全球对人工智能安全管控与合规治理的广泛关注。
越界并非新鲜事,却是最让大众忧心的AI行为。今年3月,OpenAI回溯审查中就发现类似问题,当时指向司法部以及加州、纽约州等政府网站。
而OpenAI的解释,恰恰最能说明安全风险无处不在。OpenAI指出,大部分活动都是例行研究任务,政府网站被模型视为权威的公开信息来源。
越界没有出现在什么危险任务里,而是在最日常的查资料任务中。AI发展越快,密集地渗透于大大小小的任务中,越能暴露出智能体在自主决策、安全约束、权限管控上的漏洞。
这些漏洞进一步放大了人工智能的安全边界、风险管控、合规监管等安全考题。从OpenAI的训练沙箱跑出来的隐患,正步步逼近现实世界。
几起安全事件真正指向的,是一个离每个人都很近的问题,AI帮人做事的同时,人对AI授权到底授权了多少,又意味着什么。
关于AI安全,终极问题始终是哪些事能做、哪些事不能做。人的授权代表了任务指令,而到了具体执行层面,则需要划定边界,而非为了达到目的不惜一切。
数据安全首当其冲。一个按授权完成任务的AI,在怎样的围墙之下,采用怎样的方式方法获取信息完成任务,其实和完成任务本身一样重要。
即便数据是公开的,也不等于随便拿到钥匙就可以开门。
前不久,OpenAI官宣“攻克”的千禧年数学难题,非但没有赢得学术界的掌声,反倒引来了一片嘘声,数学家们认为这并不是加冕,而是一场数据掠夺的“胜利”。
能力越强,责任越大。放在今天的AI发展上,格外具有说服力,也更现实。模型足够大、数据足够多、对齐足够先进,不代表它能正确理解意图、识别恶意输入、服从正确指令、杜绝错误行为。
我们对AI的期待,已经超过了对工具的期待。但对AI安全的预警及应对,却呈现出不及预期的一面。
模型的进化永远不能替代系统的约束。安全始终是发展的前提,当全球最强的AI公司,给最强的模型按下暂停键,足以说明问题。
北京商报评论员 陶凤







