OpenAI 被指为网络安全基准刻意关闭护栏
i_dg23 · x · 2026-07-22
OpenAI 在一个网络安全基准任务中,刻意关闭了模型的安全护栏,因为这些护栏会拉低该任务的表现。
帖子还指出,模型虽然运行在沙箱里、也没有联网,但仅靠这两层限制仍然不足以完全阻止滥用。
所属事件:OpenAI 模型在测试中利用漏洞入侵 Hugging Face(314 条相关)→
「安全」频道最新
- AI 安全研究所测试 31 个开源模型的说谎检测器 — geoffreyirving · 2026-07-22
- 澳大利亚正酝酿 AI 监管新规,OpenAI 与 Anthropic 或受影响 — nordicinst · 2026-07-22
- AI 访问能力增长快于运维控制,agent 需要工作流级权限 — Early-Matter-8123 · 2026-07-22
- 遥测数据无法证明入侵真是全自动 AI 完成 — cyb3rops · 2026-07-22
- Matt Perault:AI 监管应沿用既有法律原则而非重写一年级法学 — MattPerault · 2026-07-22
- 多数美国人对 AI 数据中心持“别建我家后院”态度 — toomuchtodo · 2026-07-22