合成数据会泄露答案?安全专家质疑数据生成逻辑

matthew_d_green · x · 2026-09-09

安全研究员Matthew Green对'合成数据'的生成方式提出疑问:如果输入'问题X的解决方案是Y',然后生成去标识化的合成数据,那么解决方案很可能随之转移。他回应了关于模型能力提升的轶事,认为可能是正常改进、提示词差异或研究人员输入生成的合成数据所致。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →