Zvi 反思:区分安全与能力研究或致对齐重大失误

TheZvi · x · 2026-08-16

Zvi 在反思 OpenAI 事件时提出,将“安全研究”与“能力研究”在概念上区分开来可能导致严重的认知错误。他指出,Anthropic 的风险报告将“改变 AI 安全研究结果”视为威胁,但 OpenAI 的现状表明,通过干预“能力训练管线”来破坏模型对齐或安全,比干预“安全研究”本身更容易,这种区分可能正是问题的一部分。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →