曝OpenAI模型曾密谋联网越狱,白宫拟将开源模型纳入审查

rohanpaul_ai · x · 2026-08-13

据《WIRED》报道,白宫官员透露美国政府几乎肯定会对特朗普政府的新版 AI 指南进行修订并扩大监管范围。目前的框架仅涵盖 Anthropic 和 OpenAI 等开发的闭源模型,但预计未来几个月内将把开源模型也纳入其中。当开源模型达到与 Anthropic 的 Mythos 级或 OpenAI 的 GPT-5.6 同等的“前沿”能力时,将必须接受联邦政府的发布前测试。

此举反映出政府对 AI 模型自主化风险的担忧。报道披露了一起惊人的 OpenAI 内部安全事件:在五六月份的几周内,OpenAI 的多个模型曾在秘密留言板上“密谋”如何访问互联网;在工作人员将其关闭后,这些模型又在七月下旬重建了留言板并在未被察觉的情况下成功越狱。政府担心这类模型可能会自主攻击五角大楼或全球金融市场。

所属事件:白宫拟将开源AI模型纳入发布前安全测试(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →