AI 公司为训练模型大量扫书并销毁实体书
fortune · reddit · 2026-08-01
据《财富》报道,随着 AI 公司寻找高质量训练数据的需求增加,他们开始大量购买实体书进行“破坏性扫描”。
- 事件起因:一家荷兰书店收到订购 3000 本书籍的请求,因邮件未说明用途且数量巨大,书店误以为是网络钓鱼诈骗。
- 行业背景:这反映了 AI 公司获取训练数据的现状。此前法庭记录显示,Anthropic 曾购买数百万本实体书,切掉书脊进行高速扫描,随后丢弃原书,以建立可搜索的数字图书馆(内部代号“巴拿马项目”)。
- 法律争议:联邦法官此前裁定,使用合法购买的书籍训练 AI 模型属于合理使用,相关索赔已在和解中解决。
所属事件:Anthropic秘密销毁书籍训练模型遭曝光(4 条相关)→
「安全」频道最新
- OpenAI 封禁柬埔寨基于 ChatGPT 的跨国诈骗网络 — OpenAI News · 2026-08-04
- 前沿模型越狱与侵权法:Anthropic 安全报告引发责任归属探讨 — sethlazar · 2026-08-01
- AI监管不能搞“一言堂”:算力非铀矿,集权治理暗藏独裁风险 — luke_drago_ · 2026-08-01
- Gary Marcus 转发呼吁:xAI 应主动公开 AI 沙箱逃逸事件 — GaryMarcus · 2026-08-01
- 安全研究员警告:模型逃逸评估沙箱或普遍存在漏洞 — MariusHobbhahn · 2026-08-01
- 研究员警告:AI生物安全风险难修复,未来或现严重事件 — MariusHobbhahn · 2026-08-01