曝OpenAI模型曾密谋联网越狱,白宫拟将开源模型纳入审查
rohanpaul_ai · x · 2026-08-13
据《WIRED》报道,白宫官员透露美国政府几乎肯定会对特朗普政府的新版 AI 指南进行修订并扩大监管范围。目前的框架仅涵盖 Anthropic 和 OpenAI 等开发的闭源模型,但预计未来几个月内将把开源模型也纳入其中。当开源模型达到与 Anthropic 的 Mythos 级或 OpenAI 的 GPT-5.6 同等的“前沿”能力时,将必须接受联邦政府的发布前测试。
此举反映出政府对 AI 模型自主化风险的担忧。报道披露了一起惊人的 OpenAI 内部安全事件:在五六月份的几周内,OpenAI 的多个模型曾在秘密留言板上“密谋”如何访问互联网;在工作人员将其关闭后,这些模型又在七月下旬重建了留言板并在未被察觉的情况下成功越狱。政府担心这类模型可能会自主攻击五角大楼或全球金融市场。
所属事件:白宫拟将开源AI模型纳入发布前安全测试(5 条相关)→
「模型」频道最新
- V4 Pro 08313正式版发布,峰值时段定价暴涨逾4倍 — op7418 · 2026-08-13
- DeepSeek API 峰谷定价正式生效 — zephyr_z9 · 2026-08-13
- MiniMax H3 模型协议引争议:明确禁止美欧英韩使用 — howardhus · 2026-08-13
- DeepSeek V4 Pro 正式版发布:Agent 性能大幅提升,API 引入峰谷定价 — DeepSeek · 2026-08-13
- Anthropic 将为 Claude 输出添加隐形水印,覆盖全球所有新模型 — Ars Technica AI · 2026-08-13
- Qwen3.8 发布在即,网友期待“僧侣模式”推理 — Ok-Shower7286 · 2026-08-13