专题 · FULL STORY

纽约时报诉OpenAI:法院令披露对话记录

《纽约时报》等控告 OpenAI 在版权诉讼中隐瞒训练数据检索能力并扣留证据。法院随后驳回 OpenAI 异议,命令其保留并向原告提供海量去标识化的 ChatGPT 聊天日志。

2026-07-10 ~ 2026-07-13 · 3 集 · 18 条

第 1 集 · 纽约时报等要求制裁OpenAI隐瞒证据(2026-07-10,12 条)

围绕 ChatGPT 的版权诉讼,争议已从“训练了什么、生成了什么”升级到“OpenAI 是否隐瞒证据”。《纽约时报》及其他原告要求联邦法院制裁 OpenAI,称其在训练数据、聊天日志可检索性等关键问题上作出误导性说明,这直接关系到原告能否证明模型复现了受版权保护内容。

争议焦点

帖文显示,共有 17 家出版商加入制裁请求。原告称,后续证词——包括一名 OpenAI 工程师在 4 月的证词——显示,OpenAI 早已具备搜索相关数据的能力,并且在《纽约时报》起诉前就开始积累后来形成去标识化聊天日志数据库的数据。被提及的规模包括 7800 万条聊天记录。原告据此主张,OpenAI 不仅隐瞒了这部分证据,也在法庭上淡化了自己建立和检索此类数据库的能力。

《纽约时报》要求获取聊天日志,是为了证明 ChatGPT 的输出会复现其受版权保护的新闻内容,这些内容可能来自训练数据,也可能来自联网搜索。OpenAI 此前则向法院表示,提供这类材料会伤害用户隐私,而且去标识化处理负担很大。原告认为,后续证词削弱了这些说法的可信度。

制裁请求与回应

根据帖文,原告申请的制裁包括金钱制裁,并要求法院禁止 OpenAI 在抗辩中使用一份 2000 万条去标识化聊天日志样本。OpenAI 曾尝试只提交这份样本,但有帖子称法院认为其内容被严重涂黑,几乎“不可用”。

OpenAI 否认相关指控。转引报道中的公司立场是,这些说法“明显虚假”,并反指《纽约时报》试图获取私人用户数据。

影响

这场争议的重要性已不只在于模型是否输出了侵权内容,也在于法院能否穿透 AI 公司的内部数据流程,审查其日志留存、去标识化与检索能力;而 OpenAI 以隐私和技术负担为由的抗辩,是否会因后续证词而受到更严格审视,也成为后续看点。

第 2 集 · OpenAI版权诉讼:法院令披露2000万条去标识化对话(2026-07-10,4 条)

在纽约联邦法院进行的OpenAI版权侵权诉讼中,一项关于用户聊天记录的争议引发关注。法院驳回了OpenAI的反对意见,命令其保留所有ChatGPT对话日志,并向原告提供约2000万条去标识化处理后的记录,用于关键词检索等诉讼用途。这一裁决加剧了公众对AI隐私与数据安全的担忧。

第 3 集 · 纽约时报指控 OpenAI 在版权诉讼中扣留证据(2026-07-13,2 条)

《纽约时报》等出版方指控 OpenAI 在双方的版权诉讼中扣留了关键证据。此前 OpenAI 曾声称无法检索训练数据中的受版权保护内容,但随后被指其实曾进行过相关搜索。出版方已要求法院对此施加制裁。这一进展标志着该起版权诉讼正在升级为更激烈的司法拉锯战,案件焦点也已从单纯的版权争议,进一步转向了取证争议与诉讼程序本身。