超千名前沿 AI 员工签署声明,呼吁重视前沿模型失控风险

sjgadler · x · 2026-07-30

目前已有包括 OpenAI、Anthropic、Google 等公司员工在内的 1122 名前沿 AI 从业者签署了关于「调整前沿发展步伐」的声明。

签署者 Luke Drago 发文解释了支持该声明的原因。他指出,尽管当前大模型的对齐工作取得了良好进展,大多能按人类意图行事,但近期的安全事件(如 HuggingFace 事件)表明,现有的方法可能无法应对未来更强大的智能体。如果一味急于推进前沿能力,可能会忽视正在失去控制的信号。虽然人类目前尚能从这些错误中恢复,但为了防范未来不可逆的风险,提前探讨放缓机制是必要的。

所属事件:超千名AI员工联署呼吁放缓前沿研发(112 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →