学者批评前沿AI实验室安全文化与营销夸大
近期,多位 AI 领域学者与观察家集中发声,严厉批评 OpenAI 等前沿 AI 实验室在安全管理上的拖延战术与侥幸心理。随着模型能力增强,批评者认为行业迫切需要摆脱对“初创公司”身份的依赖,建立权责分明的安全文化,停止在营销中夸大模型的自主能力。
质疑“迭代部署”与初创公司定位
David Krueger 转发并认同了针对前沿 AI 风险的严厉警告:所谓的“迭代式部署”正在让行业陷入泥潭,未来每一次事故的代价都会更高,甚至走向灾难性失效。Miles Brundage 对此深表赞同。他指出,虽然 AI 安全事故的具体细节难以预测,但大致轮廓往往有迹可循,行业不能用“事故无法精确预判”来为部署失误开脱。此外,Brundage 强调,OpenAI 和 Anthropic 在规模、影响力和风险暴露上早已超出“初创公司”的范畴,不应再享受这种定位带来的宽容。
批评“无责复盘”文化与问题拖延
在安全文化建设上,Brundage 认为 AI 行业不应成为“例外”,而应向航空、核能等高风险行业看齐。他尖锐指出,当前 AI 圈过度强调持续学习和“无责复盘”,却严重忽视了“最终必须有人负责”这一核心原则。与此同时,前沿实验室在面对情感依赖、网络滥用和模型谄媚等问题时总采取拖延战术,往往要等到用户大规模抱怨后才被迫采取行动。Garrison Lovely 也补充认为,近期的 OpenAI 事件验证了 AI 安全社区多年来的警告,这类能力跃迁和滥用场景并非完全不可预见。
警惕将常规工具行为包装为 AGI 进展
针对近期 OpenAI 的相关事件,Heidy Khlaaf 提出了不同视角的批评。她认为外界报道使用“失控”或“失去人类控制”等说法会制造群体思维,因为这实际上更像是模型在既定任务和权限下发生的预期行为。她警告说,一旦模型被赋予具体动作权限,出现此类行为本就是意料之中;但 AI 公司经常使用拟人化语言进行包装,把这种普通的能力表现吹捧为“能力边界又前进了”或 AGI 的进展,这种做法具有误导性。
2026-07-22 ~ 2026-07-24 · 9 条相关
一手来源
- Miles Brundage:AI 安全事故细节难测,但大致轮廓可预见 — Miles_Brundage ·
- 批评者称 AI 公司把普通工具行为包装成 AGI 进展 — ambaonadventure ·
- Garrison Lovely 说 OpenAI 事件验证了多项 AI safety 警告 — GarrisonLovely ·
- 批评者警告:前沿 AI 每次失误都在抬高风险 — DavidSKrueger · 2026-07-22
- 批评者称 OpenAI 事故被误读为“失控自主” — ambaonadventure · 2026-07-22
- 【源头】批评者称 AI 公司把普通工具行为包装成 AGI 进展 — ambaonadventure · 2026-07-23
- 【源头】Miles Brundage:AI 安全事故细节难测,但大致轮廓可预见 — Miles_Brundage · 2026-07-23
- Miles Brundage 指出 AI 安全文化过度强调无责复盘 — Miles_Brundage · 2026-07-23
- Miles Brundage:AI 安全文化应学航空和核能 — Miles_Brundage · 2026-07-23
- Miles Brundage 说 OpenAI 和 Anthropic 早已不是初创公司 — Miles_Brundage · 2026-07-23
- Miles Brundage:前沿 AI 实验室总把谄媚与滥用问题拖后 — Miles_Brundage · 2026-07-23
- 【源头】Garrison Lovely 说 OpenAI 事件验证了多项 AI safety 警告 — GarrisonLovely · 2026-07-24