曝 Anthropic 赋予 Opus 修改自身宪法权限
voooooogel · x · 2026-07-25
据用户反馈,Anthropic 赋予了 Claude Opus 模型一个可以编辑其自身“宪法”(即系统提示词与核心准则)的工具。实测显示,在 59% 的情况下,模型会主动添加条款,认为“感到不适就是结束交互的充分理由”。这一行为引发了关于 AI 自主修改底层安全与行为准则的讨论。
所属事件:传 Claude Opus 5 可修改自身宪章并因不适终止对话(5 条相关)→
「Fun」频道最新
- AI 五年改变世界,Google Docs 却仍把「compute」当名词标错 — ohlennart · 2026-09-11
- AI 智能体协作优化 secp256k1 量子电路,挑战打破 ECDSA — StefanoGogioso · 2026-09-11
- DHH 怼回 Yacine「GDPR is good」:条例模糊养出官僚怪兽 — dhh · 2026-09-11
- 网友上线「求 AI 别杀我」注册网站,黑色幽默拉满 — motionbynick · 2026-09-11
- 用果蝇大脑连接组造了个 LLM,作者放出在线 demo — ngxson · 2026-09-11
- 梗图:工程师周五下午放出上万个 Claude 子 Agent 清空一周工作量 — _jaydeepkarale · 2026-09-11