研究员称闭源模型技术安全已解决,事故多因公司走捷径
StephenLCasper · x · 2026-08-13
AI 安全研究员 Stephen Casper 发表观点认为,对于闭源权重 AI 系统而言,“技术安全”在当前阶段已是一个解决的问题。他在此语境下将技术安全定义为:编写良好的安全规范,并使 AI 模型稳健地遵循这些规范。
他指出,当前前沿的安全工具已经具备能力阻止大部分技术层面的安全违规。然而,现实中闭源模型依然频发安全事故,根本原因并非缺乏技术手段,而是AI 公司在部署和运营中走了太多捷径。因此,他强调自己已不再从事闭源模型的安全防护工作。
「漫话AGI」频道最新
- 学者视角转变:AI撞墙概率不足5%,将替代而非辅助人类 — aran_nayebi · 2026-08-13
- SPAR 推出 AI 与动物福利比较研究项目 — aran_nayebi · 2026-08-13
- 告别琐碎代码:LLM 正让我探索更深度的计算机科学 — generativist · 2026-08-13
- AI 时代的深度学习:浅尝辄止并非能力问题 — generativist · 2026-08-13
- LLM 精神病?其实是新手的好奇心与试错 — generativist · 2026-08-13
- 预测称 2026 年是人类最后一个“正常”年份 — imjustnewatai · 2026-08-13