OpenAI「不排除用脱敏数据训练」引爆抢发质疑

OpenAI承认「无法排除脱敏后的产品使用数据被用于改进模型」后,一场围绕训练数据伦理与学术成果归属的争论在研究者社区迅速发酵。起因是用户irldanB抱怨OpenAI只要剥离身份信息,就能从他与ChatGPT一年多协作产生的、他自认为堪比千禧年大奖/菲尔兹奖水准的代码记录中学习,并在传闻他即将完成之际抢先把成果做出来,他提到Anthropic曾有类似案件。以色列NLP学者Yoav Goldberg点出核心区分:「我接受模型用我的数据训练并公开发布」与「我接受用我最新成果训练的内部模型抢发解题」完全是两回事;Boaz Barak补充称用户可选择退出(去标识化)数据用于训练。

已确认

争议与质疑

为什么重要

2026-09-09 ~ 2026-09-09 · 9 条相关

一手来源