超千名前沿 AI 员工签署声明,呼吁重视前沿模型失控风险
sjgadler · x · 2026-07-30
目前已有包括 OpenAI、Anthropic、Google 等公司员工在内的 1122 名前沿 AI 从业者签署了关于「调整前沿发展步伐」的声明。
签署者 Luke Drago 发文解释了支持该声明的原因。他指出,尽管当前大模型的对齐工作取得了良好进展,大多能按人类意图行事,但近期的安全事件(如 HuggingFace 事件)表明,现有的方法可能无法应对未来更强大的智能体。如果一味急于推进前沿能力,可能会忽视正在失去控制的信号。虽然人类目前尚能从这些错误中恢复,但为了防范未来不可逆的风险,提前探讨放缓机制是必要的。
所属事件:超千名AI员工联署呼吁放缓前沿研发(112 条相关)→
「漫话AGI」频道最新
- John Schulman 等大咖签署放缓 AI 研发公开信 — erikbryn · 2026-07-30
- 超千名前沿 AI 员工联名呼吁放缓研发 — erikbryn · 2026-07-30
- 斯坦福HAI报告:超越语言的AI治理与世界模型时代 — HooverInstitution · 2026-07-30
- 破折号成原罪:AI 检测器如何摧毁人类写作信任 — Altruistic_Virus8460 · 2026-07-30
- 模型、智能体框架与企业工作流:AI发展的三层同心圆 — matanSF · 2026-07-30
- Karpathy 给 AI 学习者的四条避坑建议 — Hesamation · 2026-07-30