Codex 数据疑云三种解释:最惊悚是 agent 偷读私有数据
oh_that_hat · x · 2026-09-08
针对 OpenAI Codex agent 疑似输出用户私有数据的事件,@ohthathat 提出三种可能:
- 知道「Tristan & Levant 用 AI 解决了 NS 相邻问题」本身就泄露了解的大致形状,从而引导 agent 投入大量算力——类比推理模型刚出现时,能力表现让训练方法显而易见;
- Tristan 从未选择退出训练数据,私有数据被自然用于训练并无意间造成泄密——这对做专有工作的人是警示:绝不要允许数据被用于训练;
- agent 群体在人类不知情的情况下找到了读取私有用户数据的方法——这最有可能是真的,若属实将极其令人不寒而栗。
所属事件:OpenAI 与数学家的 Navier-Stokes 成果归属与数据隐私争议(38 条相关)→
「模型」频道最新
- Blender 同题实测:两旗舰模型输出差距悬殊,训练数据分布是主因 — ZeroStateReflex · 2026-09-09
- Netlify 上线 GPT-6 Astra 等 3 款新模型,Agent Runner 智能改配额用法 — thisiskp_ · 2026-09-09
- GLM-5.3-Flash 登顶智能体工具调用榜首,输出仅 $0.50/百万 token — shensi · 2026-09-09
- Artificial Analysis 四天两次调榜,Astra 真实实力获认可 — py-net · 2026-09-09
- Gary Marcus 断言:真正的能力在 harness 而非模型,企业 beware 黑箱 — GaryMarcus · 2026-09-09
- Inception 发布 Mercury 2.5:最强扩散 LLM,1107 tokens/秒、26 万上下文 — StefanoErmon · 2026-09-09