安全从业者:给 AI 员工生产力就要放开权限,安全检查成拖累

joshua_saxe · x · 2026-09-04

AI 安全研究者 Joshua Saxe 在与 Simon Gadler 的讨论中回应称,随着 agent 自主性提升,「把 agent 关进 padded room」式的高强度安全管控重要性会下降,但人类组织至今仍对员工普遍采用类似监督。

他指出核心矛盾在于:agent 要有生产力就需要大量权限和操作空间,这天然扩大了安全失守的攻击面;严格执行安全管控会显著拖慢 agent 的工作效率。这是 AI 劳动力安全与效率之间难以两全的结构性权衡。

所属事件:安全专家 Joshua Saxe 梳理 Agent 时代安全与对齐分工(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →