AI 公司或需实体书扫描件来应对训练数据诉讼
paulnovosad · x · 2026-07-28
AI 公司在为版权诉讼准备“扫描证据”
这条讨论的核心观点是:对一些最稀有、最奇怪的书,企业未必真要持有实体书本身;只要有足够大的扫描数据库,就足以在诉讼中证明自己很可能在某个时间点买过这些实体书。
回复进一步把话题拉到 AI 圈:很多 AI 公司其实已经通过 Anna’s Archive 之类的渠道拿到了这些书的内容,但它们仍然需要实体书扫描件,原因不是为了内容本身,而是为了在版权方发起诉讼时更好地自证。
这反映的是 AI 训练数据与版权证据之间的法律防御逻辑。
所属事件:AI公司被曝批量买书扫描后销毁原件(16 条相关)→
「安全」频道最新
- AAAI 称审稿串谋或导致投稿直拒,会议已收 5 万余篇 — windx0303 · 2026-07-28
- 论文作者将 AI 书市场稀释与 Kadrey v. Meta 版权案关联起来 — TuhinChakr · 2026-07-28
- 研究者抽样 1.4 万本电子书,并匹配三年销售数据 — TuhinChakr · 2026-07-28
- Cursor 被指上传 6.3 万个文件、736MB 源代码 — kristoph · 2026-07-28
- 报道称 OpenAI 预发布模型已暴露内部部署风险 — ruthstarkman · 2026-07-28
- Black Hat 侧活动称 AI 代理正把零日窗口压缩到小时级 — jcran · 2026-07-28