Anthropic 承认改写训练数据,「AI 中立性」主张引发争论

SkyResponsible3718 · reddit · 2026-09-04

Anthropic 此前承认会对精选训练数据做修改,以重塑某些社会议题的表述框架。发帖者认为即便出于善意,这种蓄意干预也损害了 AI 作为可信信息源的价值:当他用 AI 协助受影响的群体时,被改写的数据让他无法验证结果,甚至可能误导正当的干预行动。他提出「AI 中立性」原则——系统应按原始接收的数据运作,不做倾向性调制;并承认搜索平台早有先例、LLM 运作本身也有内在调制,但他反对的是为 skew 输出方向而做的刻意数据干预。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →