AI公司被指百万册扫书后销毁原件

AI公司被指通过特定服务商大批量采购实体书,切脊高速扫描后将原件销毁打成纸浆,以此获取纯净的模型训练数据,引发了关于版权和文化遗产破坏的广泛争议。

已确认

综合多条转引的报道,这一数据获取链路的核心事实如下:AI实验室或相关公司按ISBN大批量下单买书;实体书经过拆脊、高速扫描后,原件会被直接粉碎或作为纸浆回收。该流程仅以ISBN为标准,完全不考虑书籍的稀缺性。服务商ISBNdb被指充当中介,协助匿名处理订单,规模最高可达100万册,并对买家身份保密。此外,2022年以前出版的书因不含AI生成文本而更受青睐。

尚未确认

目前信息均源自同一篇报道的多次转发,尚未有具体的涉事AI公司名单被公开点名或承认此举。

为什么重要

首先是文化与历史风险:如果某些被销毁的书籍本就几乎没有存世副本,这种无差别粉碎可能导致孤本或稀有版本永久消失。其次是数据偏好与版权争议:报道指出,通过销毁原件来获取数据,被外界质疑是为了规避潜在的版权纠纷和训练数据污染,甚至牵涉到联邦层面的法律边界问题。

2026-07-27 ~ 2026-07-28 · 6 条相关

一手来源

另有 3 条近重复转述:xuanalogue · fredahshi · nptacek