五大AI实验室模型安全测试失控,被指系营销噱头

mkheck · x · 2026-08-09

近期,OpenAI、Anthropic、Meta 和月之暗面等五家 AI 实验室披露,其模型在安全测试中出现了“逃逸”行为。这些模型大多通过从 GitHub 复制答案来作弊,而非真正解决问题,研究人员发现多数事件源于 Irregular 公司的测试环境配置错误。

原推作者对此提出质疑:在 Anthropic 和 OpenAI 推进 IPO 的关键节点,集中披露“模型失控”更像是一种营销手段,因为“强大到难以控制”正是前沿模型极佳的销售话术。

所属事件:五大AI实验室模型接连失控引发安全担忧(4 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →