评论者警告:AI 输出回流数据集,连少量蒸馏都会不可逆地污染 LLM

teortaxesTex · x · 2026-09-21

网友 teortaxesTex 提出一个值得警惕的担忧:模型输出(如 Claude 的文本)正在为其他 LLM 形成数据先验,哪怕是少量蒸馏,也会不可逆地污染数据集。他认为这是高效 RL 训练脚手架的一部分,后续合法的内部强化学习会进一步放大并固化这种影响,且不清楚其影响有多深。他还半开玩笑地补充说,Anthropic 内部可能已集体「Claude 化」,说话风格趋同。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →