Miles Brundage 批评前沿AI公司安全文化

前 AI 政策研究员 Miles Brundage 近期针对前沿 AI 公司的安全文化与责任归属发表了系列看法。他指出,OpenAI 和 Anthropic 的规模与风险暴露早已超出范畴,不应再被贴上“初创公司”的标签,这会变相成为逃避高安全标准的借口。

事故可预见性与拖延处理

Brundage 认为,尽管 AI 安全事故的具体细节难以预测,但其大致轮廓往往有迹可循。他因此批评了将“迭代部署”作为挡箭牌的做法,指出很多风险并非前所未见。此外,他观察到前沿 AI 实验室在处理情感依赖、网络滥用和模型谄媚等问题时总是反复拖延,通常要等到用户强烈抱怨后才真正采取行动。

呼吁借鉴高风险行业经验

针对当前 AI 行业的安全文化,Brundage 警告称该领域过度偏向“无责复盘”,对“最终必须有人负责”这一原则重视不足。他呼吁 AI 行业不应视自己为“例外”,而应学习航空、核能等传统高风险行业的经验,在保持宽容学习氛围的同时,建立起严格的问责机制,防患于未然。

2026-07-23 ~ 2026-07-23 · 5 条相关

事件全程(共 20 集)→