安全研究员爆料:AI公司安全团队只顾下两代模型

geoffreyirving · x · 2026-09-10

Geoffrey Irving 转述与某前沿 AI 公司安全负责人的对话:该公司的安全组织架构是团队 A 负责对齐下一代模型、团队 B 负责再下一代,但没有任何人在为更远期的模型做对齐工作。

他补充指出,当前 AI 公司面临的安全压力迫使团队优先做“紧急补丁式”的安全修复,而牺牲了那些能经受超级智能考验的长期安全研究,后者实际上根本没人做。

所属事件:OpenAI研究员Irning:救火式安全补丁挤占超级智能对齐研究(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →