MIRI 研究员自嘲:如今只能保证「公开版 ChatGPT」明天不会杀你
connoraxiotes · x · 2026-09-26
MIRI 研究员 Nate Soares(@So8res)发帖自嘲自己的论证立场正在悄然变化。他说,过去他可以理直气壮地讲「ChatGPT 又不会明天醒来就试图杀死你」,而现在只能说「公开版本的 ChatGPT 不会明天就试图杀死你」——措辞里悄悄加上的限定词,反映出他眼中的前沿模型风险图景已经和几年前大不相同。这条帖子以简短的黑色幽默方式,呈现了 AI 安全阵营内部对模型能力演进速度的担忧变化,也引发了对「哪些部署方式才算安全」的讨论空间。
「漫话AGI」频道最新
- François Fleuret:自回归模型可以实现形式上不具备的能力 — francoisfleuret · 2026-09-26
- cnakazawa 后悔把工程要素命名为「Taste」:人人都自称有品味 — cnakazawa · 2026-09-26
- 放慢 AI 研发反或成万亿利润最快路径?算力经济账引热议 — JOBhakdi · 2026-09-26
- ICLR 2027 截稿倒计时:教授喊话 AI 智能体写论文 — CSProfKGD · 2026-09-26
- 《机器意识之 perspectives》出版,Daniel Hulme 提出意识「转轮」新理论 — cccalum · 2026-09-26
- CAPTCHA 已失效:AI Agent 时代急需新的人机验证体系 — RachelVT42 · 2026-09-26