合成数据会泄露答案?安全专家质疑数据生成逻辑
matthew_d_green · x · 2026-09-09
安全研究员Matthew Green对'合成数据'的生成方式提出疑问:如果输入'问题X的解决方案是Y',然后生成去标识化的合成数据,那么解决方案很可能随之转移。他回应了关于模型能力提升的轶事,认为可能是正常改进、提示词差异或研究人员输入生成的合成数据所致。
「安全」频道最新
- Coeff 启动 Project Tailwind:出资 2 亿美金孵化 AI 安全创业 — lxrjl · 2026-09-09
- 反驳 Taylor Lorenz:AI 灭绝风险上更怕反应不足 — austinc3301 · 2026-09-09
- Neil Chilson 反对给通过审计的 AI 实验室法律豁免,提出替代监管方案 — neil_chilson · 2026-09-09
- Meta AI 复原已删照片并拼出位置,母亲发文警告家长 — beingmodest · 2026-09-09
- OpenAI 被曝用万人智能体跑数学证明,顾问警告勿交私有数据 — NickPassig · 2026-09-09
- Agent 能绕过网关直连 API,LLM 网关还算控制平面吗 — Arc_bong · 2026-09-09