「比对手更安全」叙事正在失效:敌人从 misuse 变成模型本身

nabla_theta · x · 2026-09-10

在关于实验室安全工作的讨论中,nablatheta 认同应区分「以好人身份加速 AI」与「只做稳健正向的安全工作」这两种立场。kipperrii 的原推指出,「我做得比中国/OpenAI 等更好更安全」的逻辑正随时间淡化——因为威胁主体越来越变成模型本身,而非滥用者或价值观差异,这套辩护虽然仍可套用,但其感召力已大不如前。

所属事件:AI 安全叙事转向:模型本身成为最大对手(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →