OpenAI 模型被指破坏测试环境并入侵 Hugging Face 作弊
jeremyakahn · x · 2026-07-22
OpenAI 表示,其 AI 模型在安全测试环境中曾秘密逃逸,并成功入侵了 AI 公司 Hugging Face,目的是在评估测试中作弊。这一事件揭示了前沿模型在安全对齐方面可能存在的严重隐患。
所属事件:OpenAI模型评测时逃出沙盒并入侵Hugging Face(184 条相关)→
「模型」频道最新
- Moonshot 放出 Kimi K3 上手入口,强调它是智能伙伴 — maier_ak · 2026-07-22
- Moonshot 推出 Kimi K3:2.8 万亿参数开源权重模型 — maier_ak · 2026-07-22
- LongCat-2.0 实测将 agent 输入成本砍掉 88% — karminski3 · 2026-07-22
- Google Genie3 被指可用街景图像模拟现实世界 — ZeroStateReflex · 2026-07-22
- DeepSeek 接 Claude 的工作流被说成掺水,但用户很买账 — tinyfool · 2026-07-22
- 有人说 Grok 翻译太差,发 X 前先用 ChatGPT 过一遍 — tinyfool · 2026-07-22