ITBear旗下自媒体矩阵:

数百万实体书遭AI公司“吞噬”:数据狂欢背后文化遗产何去何从?

   时间:2026-08-27 02:59:05 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

一场围绕实体书的隐秘产业行动正在全球科技领域悄然展开。美国多家人工智能企业近期被曝出系统性收购、扫描并销毁数百万册实体书籍,这一行为引发了关于文化遗产保护与数据权益的激烈讨论。据调查,这些企业通过特殊渠道获取大量二手书籍,在完成数字化处理后立即销毁原件,其核心动机是为AI模型训练获取所谓"纯净人类数据"。

科技调查机构披露的内部文件显示,某知名AI公司自2024年初启动代号"巴拿马计划"的项目,投入数千万美元建立专门团队处理二手书籍。该项目负责人具有图书数字化领域的资深背景,其采购网络覆盖全球主要二手书交易平台。文件明确记载,该企业要求供应商具备每月处理50万至200万册书籍的能力,并特别强调操作过程的保密性。这种破坏性扫描模式在科技行业引发连锁反应,多家数据服务商开始公开兜售类似业务。

行业动向显示,2022年前出版的书籍成为争夺焦点。某数据库公司曾推出"无AI污染"图书采购服务,声称这些出版物经过严格筛选,能够确保训练数据的原始性。尽管该服务在媒体曝光后迅速终止,但追踪调查发现,欧洲古董书市场同期出现异常采购现象,大量冷门专业书籍被匿名买家收购,最终流向某电商巨头的物流中心。内部员工证实,该中心设有专门区域进行书籍拆解扫描作业。

驱动这场数据争夺战的深层原因,在于AI模型面临的"数据退化"危机。学术研究表明,当模型持续使用机器生成内容训练时,会逐渐丧失处理多样化信息的能力。最新监测数据显示,互联网新增英文内容中AI生成比例已突破70%,这导致2022年之前的出版物成为稀缺资源。行业专家指出,书籍经过专业编辑审核,其结构化知识体系对提升模型质量具有特殊价值,这种特性使实体书在数据市场中身价倍增。

法律层面的争议聚焦于版权与物权的边界。美国联邦法院近期裁决认定,购买实体书后的数字化处理属于合理使用范畴,但明确禁止通过盗版渠道获取电子版本。某AI企业因此就侵权问题达成巨额和解,涉及近50万部作品。然而,法律判决未能平息文化界的担忧,文献保护专家警告,大规模销毁实体书可能导致珍贵文献永久消失,这种损失无法用数据备份弥补。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version