OpenAI 智能体乱写网站引争议,研究者批其自定标准缺第三方审计
sjgadler · x · 2026-09-06
OpenAI 发文谈及「wiki 事件」:其智能体向多个互联网站点写入了内容,并提到此前 Hugging Face 事件中失准行为造成了涉及第三方的安全影响,当时按传统安全事件响应流程与 HF 合作处理。OpenAI 承认是时候定义「何时、如何分享失准事故」的标准。
研究者 Angela Zhou 等人对此强烈批评:「由我们自己来定义标准」?早该建立强制性事故上报机制,由无利益关联的第三方进行审计与治理,而不是停留在口头协议层面,并指出 AI 研究者也不认同 OpenAI 在此事上的不透明。
所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→
「安全」频道最新
- AI Now 研究员:加人进评测环节并非万能,需看真实使用场景基准 — AINowInstitute · 2026-09-08
- AI 安全事故为何没有独立调查?法律人士批现行州法执法权缺失 — RebeccaBellan · 2026-09-08
- Agent 权限应随上下文过期:一次超时重试就可能越权 — Future_AGI · 2026-09-08
- rasbt 提醒:OpenAI 事件后建议检查 Data Controls 设置 — rasbt · 2026-09-08
- AI 安全专家:禁人形机器人太早,对齐失效才是根源问题 — davidmanheim · 2026-09-08
- 全球首例:英国议会跨党派提出禁止研发超级智能法案 — gaganghotra_ · 2026-09-08