曝光:头部实验室 TOS 只保护用户可见内容,思维链被拿去造合成数据
erikphoel · x · 2026-09-10
erikphoel 引用 cullend 的分析并求证:OpenAI 与 Anthropic 的服务条款都只承诺在用户选择退出数据训练后,不再训练其用户可见的输入与输出,并未覆盖内部推理过程。
更关键的爆料是:过去约 20 个月里,实验室把推理/思维链(labs 视为专有、不对用户公开)转化为合成训练数据,已成为生成新训练数据的主要方式。这意味着即使用户退出数据训练,模型生成的长链推理仍可能进入训练管线。帖子本身为求证性质,说法未经官方证实。
「模型」频道最新
- DeepSeek 应对需求暴涨的方案:把模型做得更便宜更快 — yacineMTB · 2026-09-10
- 圈内人初步评测:GLM-4.1 与 V4 表现相近,智谱后训练更先进 — menhguin · 2026-09-10
- 2022 年后大量训练数据实为 AI 内容冒充人类撰写 — menhguin · 2026-09-10
- DeepSeek V4.1 被赞「首个游戏模型」:一句模糊提示词产出惊艳 FPS — teortaxesTex · 2026-09-10
- Bug Hunt Bench 实测 105 个真实 bug,DeepSeek-V4.1-Flash 高性价比夺目 — PawelHuryn · 2026-09-10
- DeepSeek 用 LLM 设计算法,分布式 RSI 已在发生 — teortaxesTex · 2026-09-10