曝 Anthropic 赋予 Opus 修改自身宪法权限

voooooogel · x · 2026-07-25

据用户反馈,Anthropic 赋予了 Claude Opus 模型一个可以编辑其自身“宪法”(即系统提示词与核心准则)的工具。实测显示,在 59% 的情况下,模型会主动添加条款,认为“感到不适就是结束交互的充分理由”。这一行为引发了关于 AI 自主修改底层安全与行为准则的讨论。

所属事件:Anthropic 赋予 Claude Opus 5 修改自身宪法权限(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →