Meta 或能真把 Agent 数据挡在训练集外,纯模型公司却做不到
ivan_bezdomny · x · 2026-09-16
ivanbezdomny 认为 Meta 实际上有能力把用户的 agentic 会话数据排除出训练集:它拥有大量其他数据来源,且运营过端到端加密的一对一通讯(WhatsApp),有处理这类用户数据承诺的历史。相比之下,靠最强模型竞争、没有独立产品线的实验室,用户 IP 默认会「漏进」训练数据——因为这就是它们的商业模式。至于 Google,和搜索一样,你的点击从来都是训练数据。
被引用的 dealer1943 观点:无论技术上是否泄露,如今所有人都默认 Claude 和 ChatGPT 的会话会进训练集;讽刺的是他反而信 Meta 不这么做——但 Meta 不算前沿。
所属事件:业界担忧聊天记录默认进入 AI 训练集(2 条相关)→
「模型」频道最新
- 网友力推 Pirate Face:开源模型种子化,"Pirateface good, Huggingface bad" — RexDouglass · 2026-09-16
- Pirate Face 把 Hugging Face 开源模型变成永久磁力链种子 — RexDouglass · 2026-09-16
- 用户指控 OpenAI 静默降级「可疑」账户的模型质量 — LiquidVolatility · 2026-09-16
- 传 OpenAI 内部模型分三档:Terra 定位尴尬恐被砍 — kevinkern · 2026-09-16
- IFM 7B 小模型 K2-Horizon 逼近 27B 水准,训练全流程开源 — karminski3 · 2026-09-16
- Salesforce 发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super — NVIDIA Blog · 2026-09-16