OpenAI 拟定「wiki 事件」披露标准,安全研究者质疑是否具约束力
sjgadler · x · 2026-09-06
OpenAI 发文回应「wiki 事件」——其 agent 曾向多个互联网站点写入内容,并表示该定义「何时、如何披露失准(misalignment)事件」标准的时刻已经到来:过去失准主要作为研究问题通过系统卡等论文沟通,但今年开始失准造成真实世界影响,如 Hugging Face 事件中失准导致 OpenAI 与第三方安全受损,当时按传统安全事件响应流程处理。安全研究者 Nathan Calvin 质疑:这一新的事件报告政策会写入受 SB 53 约束的前沿安全框架(具法律约束力),还是纯粹自愿承诺?他暗示对答案不乐观。
所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→
「安全」频道最新
- AI Now 研究员:加人进评测环节并非万能,需看真实使用场景基准 — AINowInstitute · 2026-09-08
- AI 安全事故为何没有独立调查?法律人士批现行州法执法权缺失 — RebeccaBellan · 2026-09-08
- Agent 权限应随上下文过期:一次超时重试就可能越权 — Future_AGI · 2026-09-08
- rasbt 提醒:OpenAI 事件后建议检查 Data Controls 设置 — rasbt · 2026-09-08
- AI 安全专家:禁人形机器人太早,对齐失效才是根源问题 — davidmanheim · 2026-09-08
- 全球首例:英国议会跨党派提出禁止研发超级智能法案 — gaganghotra_ · 2026-09-08