批评者指 Anthropic 安全承诺有漏洞:内部模型风险不在合规框架内

DKokotajlo · x · 2026-10-11

安全政策研究者 Nathan Calvin 转发提醒:Anthropic 的前沿合规框架完全没有涉及内部模型风险管理的条款。Anthropic 回应称「预计方法会演进」「框架会更新」,但距其前沿模型发布已数月,没有任何改动。

Garrison Lovely 补充指出,加州法律自 1 月起允许 AI 公司通过制定具法律约束力的安全计划进行自我约束,但即便是「安全公司」Anthropic 也没有真正这样做——它发布了两版安全计划,而法律约束力的是较弱的那一版。

所属事件:Anthropic 被批安全承诺留漏洞:法律约束版弱于公开版(3 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →