泡泡资讯网

疯狂扫货旧书百万册!AI一边钻法律空子,一边亲手毁掉人类纸质文明? 最近多家外媒

疯狂扫货旧书百万册!AI一边钻法律空子,一边亲手毁掉人类纸质文明?
最近多家外媒曝光一个诡异现象:欧美二手书圈迎来大批量神秘订单。大量中间商深夜下单,不问品相、不讲价格,冷门地方志、绝版专业古籍通通照单全收,谁都能猜到,背后买家清一色是各大AI企业。

很多人一头雾水,互联网海量文字随便爬,为什么巨头不惜花钱囤纸质旧书?真相一点不复杂,现在全网到处都是AI自己生成的文案,大量重复、错误、口水化内容堆积。AI反复学习AI产出的垃圾内容,会出现模型崩溃,逻辑越来越混乱,胡说概率暴涨。

2022年之前出版的纸质书是绝佳解药:完完全全由人类手写、人工编辑定稿,没有半点儿AI污染,语句严谨、逻辑完整,是训练高端大模型最优质的“干净饲料”。网上免费文本早已内卷枯竭,旧书本反倒成了AI进阶的刚需硬通货。

可最有争议的操作来了:AI收货之后不走温柔扫描,直接用机器切掉书脊,拆散整本书高速录入。全部文字提取完毕,所有原版书籍统一粉碎、打成纸浆,不留一本实体原件。Claude母公司Anthropic的“巴拿马计划”,半年内销毁足足200万册书籍,流程全部曝光在法庭卷宗里。

吵翻天的核心矛盾:合法,但扎心

支持方:商业合规,不算掠夺

美国法院给出关键判决:企业花钱合法买下实体书,拥有书籍所有权。扫描仅用于AI训练、不对外传播电子书,纸质原件销毁,属于版权“合理使用”,不算侵权 。
比起偷偷下载700万本盗版电子书、最终赔出15亿美元天价和解金,批量买书毁书是AI摸索出的合规捷径。不用挨个找作者、出版社谈授权,大幅规避天价版权官司,是成本最低的稳妥路线。科技从业者觉得,书本的价值是文字知识,纸质载体本就可以被替代,数字化留存内容,不算损失文明。

反对方:钻规则漏洞,毁掉不可再生的文化遗产

无数藏书人、文史学者怒斥这套玩法是精致的投机。很多被收购的书籍是孤本、绝版地方史料、小众外文典籍,全世界仅剩寥寥几本。AI买走扫描完就地销毁,世上再也没有这本实体书。数字化文字无法复刻古籍的纸张、排版、批注、年代痕迹,纸质文明永久消失,再也无法复原。

放在普通人视角更别扭:作者辛辛苦苦伏案数年写书,AI花钱买实体书,绕开所有版权收益,无偿收割文字价值。作者拿不到分文收益,科技公司靠着这些内容赚钱盈利。法律挑不出毛病,可情理上很难让人接受。不少作家直言:AI用这种方式薅内容,本质是换了套路的白嫖。

更深层行业悖论

如今AI陷入两头为难:全网公开数据被AI垃圾污染,没法用;正版书籍挨个拿授权成本极高,谈判周期漫长。最终行业集体盯上旧书毁灭式扫描,靠着法律条文打擦边球。

一边是科技向前狂奔,需要源源不断的优质人类文字;一边是纸质古籍不断消亡,创作者权益被变相架空。科技想要进步,一定要以消耗纸质藏书、弱化作者权益为代价吗?

有人说知识数字化是时代必然,不必执着纸书;也有人痛批巨头只为技术红利,不在乎人文传承。规则暂时偏向AI,但这场书本争夺战,至今没有让所有人信服的答案。