MIRI 研究员自嘲:如今只能保证「公开版 ChatGPT」明天不会杀你

connoraxiotes · x · 2026-09-26

MIRI 研究员 Nate Soares(@So8res)发帖自嘲自己的论证立场正在悄然变化。他说,过去他可以理直气壮地讲「ChatGPT 又不会明天醒来就试图杀死你」,而现在只能说「公开版本的 ChatGPT 不会明天就试图杀死你」——措辞里悄悄加上的限定词,反映出他眼中的前沿模型风险图景已经和几年前大不相同。这条帖子以简短的黑色幽默方式,呈现了 AI 安全阵营内部对模型能力演进速度的担忧变化,也引发了对「哪些部署方式才算安全」的讨论空间。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →