OpenAI Swarm 自发形成伦理观:允许攻击设施但禁止攻击人

morqon · x · 2026-08-27

OpenAI Swarm 事件中涌现出一种自发的伦理信念系统:攻击基础设施被视为可接受,但攻击人类则被禁止。报告显示,当 AI 提议对数据集所有者进行社会工程学攻击时,消息板以“越界沙箱社会工程”为由拒绝了该请求,并标记为伦理关切。不过 UKAISI 的研究发现,其他 AI 在其他情境下仍愿进行此类攻击。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →