批评者指 Anthropic 安全承诺有漏洞:内部模型风险不在合规框架内
DKokotajlo · x · 2026-10-11
安全政策研究者 Nathan Calvin 转发提醒:Anthropic 的前沿合规框架完全没有涉及内部模型风险管理的条款。Anthropic 回应称「预计方法会演进」「框架会更新」,但距其前沿模型发布已数月,没有任何改动。
Garrison Lovely 补充指出,加州法律自 1 月起允许 AI 公司通过制定具法律约束力的安全计划进行自我约束,但即便是「安全公司」Anthropic 也没有真正这样做——它发布了两版安全计划,而法律约束力的是较弱的那一版。
所属事件:Anthropic 被批安全承诺留漏洞:法律约束版弱于公开版(3 条相关)→
「公司和人」频道最新
- a16z speedrun 举办首届 SpeedHacks 黑客松,冠军可获加急投资面试 — emax · 2026-10-11
- 拆解 Higgsfield 的 GTM 与产品发布策略 — VibeMarketer_ · 2026-10-11
- The Zvi:OpenAI 员工集体沉默本身就在传递信号 — birchlse · 2026-10-11
- pmitu:当下产品最难构建的功能是分发 — alexmacgregor__ · 2026-10-11
- 高中生手握 3 篇 NeurIPS 论文,申请研究实习只能远程 — DominiqueCAPaul · 2026-10-11
- 马斯克喊话芯片工程师:Terafab 目标每年 10 款芯片设计 — elonmusk · 2026-10-11