Navier-Stokes 疑云发酵,业内集体辟谣 Codex 用户数据泄露
一起围绕 Navier-Stokes 论文疑云的传言称 OpenAI 可能通过访问用户聊天记录窃取研究思路、甚至用用户数据训练 Codex。DeepMind 研究员 Sholto Douglas、前 Meta 研究员 Nathan Lambert 等多位业内人士在 9 月 8 日相继公开辟谣,认为这类行为在大型 AI 公司几乎不可能发生;但关于用户数据安全边界与服务条款训练权的讨论并未就此平息。
已确认
- 传言源于 Tristan 与 Sebastien 之间的争议及 Navier-Stokes 信件,其中暗示 OpenAI 人员可能「读了用户聊天记录获取思路」,随后扩散为「Codex 用户数据不安全」的说法。
- DeepMind 研究员 Sholto Douglas 明确回应:基于外部一切信息判断,用户数据在相关事件中产生影响的概率极低,OpenAI 几乎不可能为此拉取用户对话记录,更不会以会影响结果的方式训练;他呼吁停止传播「你的用户数据在 Codex 里不安全」的说法,并对「某前沿实验室用其他模型对话日志做训练」的传言表示「这绝不可能发生」。
- 前 Meta 研究员 Nathan Lambert 表示,OpenAI 或 Anthropic 的研究员直接查看特定用户对话数据的可能性为零:科技公司在 behaviors 上的内部管控极其严格,他回忆在 Meta 时这类行为基本会被立即解雇。Sebastian Raschka 转述并认同这一观点。
- 研究员 BlackHC 提出系统性质疑:OpenAI 内部人员窃取用户对话的声誉风险显而易见,一旦曝光损害将是灾难性的,这种做法「错得过于卡通」,不可能是官方行为,他预期内部会很快有人站出来发声。
- 开发者 Aaron Bergman 持不同立场:无论 Codex 还是 Anthropic,用户数据都谈不上绝对安全。
- 开发者 arohan 补充事实:几乎所有 AI 模型的服务条款都写明可用用户数据训练(或有不透明的 opt-out 机制),并保留用于评测、环境等的访问权限。
- @ohthathat 对 Codex agent 疑似输出用户私有数据给出三种解释:最惊悚的是 agent 真的偷读了私有数据;但更平缓的解释是,外界已经知道「Tristan 与 Levant 用 AI 解决了 NS 相邻问题」这一事实本身就泄露了解的大致形状,足以引导 agent 产出相似结果。
尚未确认
- Navier-Stokes 论文疑云本身的事实经过、Codex 究竟如何获得相关信息,目前仍无定论,各方讨论均基于外部推测;@ohthathat 的三种解释也只是假设。
为什么重要
- 这场争论触及 AI 行业最敏感的信任问题:用户与企业的对话数据是否会被人查看或用于训练。业内人士的集体辟谣暂时平息了「Codex 数据不安全」的传言,但 Aaron Bergman 与 arohan 的提醒说明,ToS 层面的数据权利与个体研究员行为是两回事,用户对数据边界的关注不应因辟谣而完全放下。
- @ohthathat 的分析还提示了另一种可能:在信息泄漏争议中,「外界已知信息」本身就可能引导模型复现结果,未必需要假设数据被窃取。
- 事件也折射出前沿实验室与学术圈之间的张力:gerardsans 批评 OpenAI 把数学当作「新闻稿平台」、只为宣传叙事服务,虽不相信 OpenAI 偷看用户对话,但反映部分研究者对商业叙事侵蚀学术研究方式的不满。
2026-09-08 ~ 2026-09-08 · 16 条相关
- 第 1 集:OpenAI 被指截胡 Navier-Stokes 成果,Bubeck 否认指控(2026-09-08,19 条)
- 第 2 集:Navier-Stokes 疑云发酵,业内集体辟谣 Codex 用户数据泄露(2026-09-08,16 条)
- 第 3 集:数学家控诉 OpenAI 抢发 Navier-Stokes 成果(2026-09-08,12 条)
- 第 4 集:OpenAI 疑似抄袭 Anthropic 员工言论引热议(2026-09-08,2 条)
一手来源
- 开发者辟谣:Codex 并未拿用户数据训练,「数据不安全」说法站不住 — _sholtodouglas ·
- 前 Meta 研究员:大厂研究员直接翻看用户数据的概率是零 — natolambert ·
- Codex 数据疑云三种解释:最惊悚是 agent 偷读私有数据 — oh_that_hat ·
- 【源头】开发者辟谣:Codex 并未拿用户数据训练,「数据不安全」说法站不住 — _sholtodouglas · 2026-09-08
- DeepMind 研究员 Sholto 辟谣:用竞品日志训练的说法绝无可能 — apples_jimmy · 2026-09-08
- 开发者激辩 Codex 数据安全:你的对话真会被人工查看吗 — AaronBergman18 · 2026-09-08
- 研究员驳 OpenAI 窃取用户聊天爆料:声誉风险太大,不可能是官方行为 — BlackHC · 2026-09-08
- DeepMind 研究员力挺:Codex 用户数据被用于训练的猜测极不可能 — daniel_mac8 · 2026-09-08
- 研究者质疑「OpenAI 偷看用户聊天」指控:风险太大不划算 — BlackHC · 2026-09-08
- 数学家质疑 OpenAI 借数学研究做宣传,力挺其不会偷看用户对话 — gerardsans · 2026-09-08
- 【源头】前 Meta 研究员:大厂研究员直接翻看用户数据的概率是零 — natolambert · 2026-09-08
- 前 Meta 研究员:质疑前沿实验室偷看用户数据是「新手操作」 — natolambert · 2026-09-08
- Codex 泄题传言引争议,研究者称用户数据被训练说法极不可能 — scaling01 · 2026-09-08
- 前 Meta 研究员:大厂员工私查用户数据基本不可能,管控极严 — rasbt · 2026-09-08
- 业内人士辟谣:称 OpenAI 读用户聊天记录获取灵感纯属谣言 — joshgans · 2026-09-08
- AI 圈争论 Codex 数据隐私:几乎所有模型 ToS 都保留训练权 — _arohan_ · 2026-09-08
- 【源头】Codex 数据疑云三种解释:最惊悚是 agent 偷读私有数据 — oh_that_hat · 2026-09-08
另有 2 条近重复转述:apples_jimmy · AaronBergman18