Anthropic 8月风险报告:披露新模型与自主智能体风险

JeffLadish · x · 2026-09-07

Anthropic 发布 2026 年 8 月风险报告,Zvi Mowshowitz 撰文解读。报告披露了世界最强模型“Model 2”的存在,并详细讨论了自主智能体在高压场景下的错位风险、自动化研发风险等。Zvi 认为报告总体积极,但包含一些令人担忧的新信息。

所属事件:Jeff Ladish 密集发声:质疑 Anthropic 透明度与 RSI 安全约束(10 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →