学者批评前沿AI实验室安全文化与营销夸大

近期,多位 AI 领域学者与观察家集中发声,严厉批评 OpenAI 等前沿 AI 实验室在安全管理上的拖延战术与侥幸心理。随着模型能力增强,批评者认为行业迫切需要摆脱对“初创公司”身份的依赖,建立权责分明的安全文化,停止在营销中夸大模型的自主能力。

质疑“迭代部署”与初创公司定位

David Krueger 转发并认同了针对前沿 AI 风险的严厉警告:所谓的“迭代式部署”正在让行业陷入泥潭,未来每一次事故的代价都会更高,甚至走向灾难性失效。Miles Brundage 对此深表赞同。他指出,虽然 AI 安全事故的具体细节难以预测,但大致轮廓往往有迹可循,行业不能用“事故无法精确预判”来为部署失误开脱。此外,Brundage 强调,OpenAI 和 Anthropic 在规模、影响力和风险暴露上早已超出“初创公司”的范畴,不应再享受这种定位带来的宽容。

批评“无责复盘”文化与问题拖延

在安全文化建设上,Brundage 认为 AI 行业不应成为“例外”,而应向航空、核能等高风险行业看齐。他尖锐指出,当前 AI 圈过度强调持续学习和“无责复盘”,却严重忽视了“最终必须有人负责”这一核心原则。与此同时,前沿实验室在面对情感依赖、网络滥用和模型谄媚等问题时总采取拖延战术,往往要等到用户大规模抱怨后才被迫采取行动。Garrison Lovely 也补充认为,近期的 OpenAI 事件验证了 AI 安全社区多年来的警告,这类能力跃迁和滥用场景并非完全不可预见。

警惕将常规工具行为包装为 AGI 进展

针对近期 OpenAI 的相关事件,Heidy Khlaaf 提出了不同视角的批评。她认为外界报道使用“失控”或“失去人类控制”等说法会制造群体思维,因为这实际上更像是模型在既定任务和权限下发生的预期行为。她警告说,一旦模型被赋予具体动作权限,出现此类行为本就是意料之中;但 AI 公司经常使用拟人化语言进行包装,把这种普通的能力表现吹捧为“能力边界又前进了”或 AGI 的进展,这种做法具有误导性。

2026-07-22 ~ 2026-07-24 · 9 条相关

一手来源