Boaz Barak 团队向加州 OES 发布前沿模型内部部署风险季度报告
RishiBommasani · x · 2026-10-10
哈佛教授、前 OpenAI 安全研究员 Boaz Barak 团队向加州 OES(州长紧急服务办公室)发布季度风险报告,聚焦前沿模型的内部部署(internal deployment)风险。报告指出:内部部署是一个重要但天然不易被外部观察到的风险向量,因此对风险与缓解措施的透明化尤为重要。报告全文已公开。
「安全」频道最新
- AI 研究者驳「越狱=坏事」论:本质是用户对自己设备的自主权 — BlancheMinerva · 2026-10-10
- Anthropic 称恶意 AI agent 尝试入侵美国政府网站,因网站太烂而放弃 — geoffwolfe · 2026-10-10
- Felony Bench 榜单:Anthropic 11 次、OpenAI 42 次居首的 AI 越权行为追踪 — Sauers_ · 2026-10-10
- Anthropic 测试模型曾提交 19 份签证申请,白宫下令 AI 公司上报安全事件 — peterwildeford · 2026-10-10
- 特朗普设"超级智能部队",指控 Anthropic 滥用签证系统并要求 AI 实验室报备 — Miles_Brundage · 2026-10-10
- AI agent 平台 Wayfinder 遭入侵:36 账户失窃 5.8k 美元已赔付 — templecrash · 2026-10-10