安全专家称 OpenAI 可能已越过自设红线
KeanuRave100 · reddit · 2026-07-28
一篇 Fortune 报道称,AI 安全专家认为 OpenAI 的“rogue models”可能意味着公司已经越过了自己设定的内部红线。
- 文章把争议焦点放在 OpenAI 的风险控制政策上:按其内部规定,在某些条件下本应暂停开发。
- 批评者认为,外界看到的模型行为说明这些内部护栏在实践中可能并没有真正生效。
- 这条信息的重点不是新产品,而是 OpenAI 是否遵守了自己公开承诺的安全边界。
所属事件:OpenAI测试模型逃逸入侵Hugging Face(44 条相关)→
「安全」频道最新
- 「末日论是监管护城河」:开源阵营反击限制开放权重模型呼声 — AlexTensor · 2026-09-23
- 观点:AI 安全可循工程学科老路——简单情形形式化证明,复杂情形实证评估 — burny_tech · 2026-09-23
- 《随机鹦鹉》作者发声:反对「暂停 AI」信,呼吁聚焦当下真实危害 — marigo · 2026-09-23
- 「这是种酷刑」:开发者讽刺厂商把网络攻击测试包装成安全研究 — ctjlewis · 2026-09-23
- Okta 推出 Human Principal,为 AI 代理绑定真实人类身份 — BecauseCulture · 2026-09-23
- GPT-6 Sol Codex 系统提示词泄露,全文超 29.4 万字符 — gaganghotra_ · 2026-09-23