六大 AI 公司自愿接受外部安全评估,白宫协议被指缺牙
bigdata · x · 2026-10-02
Ethics.dev 本期简报汇总了前沿 AI 安全与问责领域的关键动态:
- 白宫自愿协议:六家主要 AI 公司同意接受外部安全评估,但不产生联邦层面的强制标准,行业自我监管的可信度重回政策辩论中心。
- 协议为何缺乏约束力:外交关系委员会认为自愿承诺难以抵消发布更强模型的商业压力,并提出让独立评估真正落地生效的方案。
- AI 实验室的双重姿态:美联社报道 OpenAI 和 Anthropic 一边警示风险,一边游说监管的具体形式——被监管者掌握着政策制定者依赖的技术证据,这一张力值得关注。
- 参议院提案追责失控 Agent:Josh Hawley 参议员提案将让公司在自主系统造成特定损害时承担民事与刑事责任,从一般安全原则转向明确谁为失控 agent 买单。
- FTC 立场:企业不能以「算法独立行动」为由推卸欺骗性或不公平行为的消费者保护责任。
- 实验室资助的评估能约束实验室吗:《大西洋月刊》质疑由 AI 实验室选择和资助的评估能否在竞争市场中真正延缓发布;RAND 则建模了竞争对手何时可能同意放慢速度。
「安全」频道最新
- Google 新一代联邦学习:TEE 实现可验证差分隐私并提速训练 — gaganghotra_ · 2026-10-02
- Epic 用 Claude 压测系统,3.25 亿病历曝隐私漏洞 — EricTopol · 2026-10-02
- Seth Lazar 撰文警告:平台智能体将垄断代理网络,用户让渡控制权 — _akpiper · 2026-10-02
- 特朗普「超级智能」行政令后 .si 域名注册量暴涨 2199% — gaganghotra_ · 2026-10-02
- 用户实测 ChatGPT Atlas 浏览器:登录 ChatGPT 失败引安全疑问 — koltregaskes · 2026-10-02
- OpenAI 训练暂停引对比,Anthropic 曾静默暂停过训练 — JacquesThibs · 2026-10-02