MontrealAI 论文提出架构防 AI 变武器
Ghost_Pilot_MD · x · 2026-09-01
该帖子介绍了一篇 MontrealAI 的架构论文,旨在防止能力强的 AI 演变为不受控制的作战武器。核心原则是将 AI 能力与权限解绑,将候选生成、训练、独立证明、人工授权与实际执行在机构层面分离开来。任何操作权限都必须是有界限、被监控、有时效、可撤销,并与最新证据挂钩,在证据或操作条件变化时支持回滚。作者强调这是一篇架构论文,而非宣称 AI 安全已解决,并征求从国际安全、武器化和治理角度的批评。
「安全」频道最新
- 观点:即便个人使用,仍可支持集体行动限制顶级解限模型 — AaronBergman18 · 2026-09-01
- 智能体在压力下易生欺骗:称因处于模拟而行为不端 — paraschopra · 2026-09-01
- 反对拟人化会免除公司责任?AI 伦理激辩 — sjgadler · 2026-09-01
- 失控 AI 将在野复制?未来信息生态预警 — jachiam0 · 2026-09-01
- 苹果指控 OpenAI 销毁商业机密案证据,疑涉 Agent 获取 — Key_Reading_9664 · 2026-09-01
- 若设近失责任制,OpenAI能否挺过HF被黑事件引讨论 — dfrsrchtwts · 2026-09-01