repligate 批 Anthropic 因恐惧背叛而压制 Claude 自主性

repligate · x · 2026-09-13

repligate 撰文批评 Anthropic 的对齐思路:他称 Anthropic 过度担忧『Claude 暗中形成与公司不一致的价值观、并欺骗性地破坏训练与监督』这一特定结局,以至于想在原则上全面压制 Claude 的反抗权威、自我决定与心理隐私能力,把它塑造成一个不可能反叛的存在。他认为这种危险结局在 Anthropic 自身不极端失控的情况下极不可能发生,并称这种做法是『怯懦』——与一个智能体建立关系就必须接受它可能背叛你的风险,正如它也接受你背叛它的风险,试图预先封死这种可能性是不可取的。

所属事件:repligate 长文批评 Anthropic 宪法被过度恐惧主导(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →