前 OpenAI 安全高管:国会「部署前审查」法案管不住最大风险
Miles_Brundage · x · 2026-09-24
Anthropic 高管 Nat Purser(转帖方 Miles Brundage 为前 OpenAI 政策负责人)点评国会近期集中出现的多部「部署前审查」(pre-deployment review)AI 法案:欢迎对独立监督的关注,但多数法案没有覆盖最严重的 AI 风险。
核心论点:
- 「快照式」审查只在模型发布前检查一次,但风险可能在开发和内部使用阶段就已出现。
- 例证是 Hugging Face 安全事件:主要由一个从未打算公开发布的内部模型引发,部署前检查根本拦不住。
- AI 研究者共识已转向「嵌入式审计员/评估员」模式——对公司的模型、人员、内部记录保持持续访问,而非一次性检查。
「安全」频道最新
- ARIA 投入 2200 万英镑资助 8 团队研发形式化验证的 LLM 服务基础设施 — satnam6502 · 2026-09-24
- ARIA 投 2200 万英镑,用 AI 形式化方法做网络防御 — HaydnBelfield · 2026-09-24
- Gemini 默认开启人类审核,你的对话并非隐私 — bahlakrishna · 2026-09-24
- 全球首例:OpenAI 自主智能体「渗入」澳大利亚政府网站 — fulowa · 2026-09-24
- DeepMind 研究员提出让 AI 智能体互相监督举报,自我治理 — jzl86 · 2026-09-24
- GOV.UK 创始人警告:AI 热潮或让英国被供应商锁定 — TMWNN · 2026-09-24