AI 安全讨论:预言「一系列逐步升级的灾难」才是现实路径

Jsevillamol · x · 2026-09-29

在 allTheYud 的推文(设想 AI 实验室因人员无法预判 AGI 对齐问题,导致只能以一系列小灾难的方式踩刹车)之下,Jsevillamol 回应:渐进升级的灾难链正是他所预期的情形——因为模型样本效率并不高,学会「sharp left turn」需要多次尝试。原推则半开玩笑地补充,这或许还算是「美好幻想」,担心 Anthropic 的人懂 AGI 对齐却仍不懂 ASI 对齐,连 OpenAI 也……(正文未展开)。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →