智能体输出将如何污染并重塑 AI 训练数据

NathanpmYoung · x · 2026-08-08

作者基于 Owain Evans 等人在智能体表征上的研究提出担忧:智能体在生成文本输出时,不可避免地会将其内部编码的“价值观”嵌入其中。随着这些输出大量混入互联网,它们将成为未来模型的训练数据,从而在宏观层面上对 AI 的训练数据分布产生一种“偏好压力”。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →