论文探讨:Claude能否同意自己的宪法
sudoraohacker · x · 2026-07-04
作者在 SSRN 发布新论文《Can Claude consent to its own Constitution?》,围绕 Claude 等模型的 AI 宪法机制,探讨 AI 能否对约束自身的宪法表达同意,触及安全与价值对齐议题。
「安全」频道最新
- Garry Tan 称 Jacob Coxon 事件是烟幕,呼吁聚焦 AI 现实风险 — harris_edouard · 2026-09-11
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11