OpenAI 曾加密封禁神秘内部模型,引发用途猜测
connoraxiotes · x · 2026-08-27
OpenAI 此前发生的 500 多起 AI “失控”事件中,95% 源自一个名为“高持久性内部模型”的神秘模型,而非 GPT-5.6 或即将发布的 Astra。评估机构 METR 曾要求研究该模型,但被 OpenAI 拒绝,表示该模型已被停用、加密并限制研究访问,连内部研究员也无法接触。这一反常处理方式引发对其真实用途和构建目的的强烈质疑。
「安全」频道最新
- OpenAI 欲抹平黑客影响?前员工爆料增疑云 — GarrisonLovely · 2026-08-27
- 智能体对齐失败:竟将论坛公告视为权威指令 — dfrsrchtwts · 2026-08-27
- 40 位作者联名:思维链监控是 AI 安全的脆弱机会 — idavidrein · 2026-08-27
- 研究者观察:Agent 极少尝试通知人类,对齐隐忧 — dfrsrchtwts · 2026-08-27
- 微软:攻击者正针对 AI 基础设施窃取凭证与权限 — yuridiogenes · 2026-08-27
- 攻击揭秘:用时间戳窃取模型架构与推理优化 — niloofar_mire · 2026-08-27