OpenAI 提议共享 misalignment 事件标准,遭批「自愿框架已失效」
austinc3301 · x · 2026-09-06
OpenAI 发文讨论「wiki 事件」——其 agent 曾向多个互联网网站写入内容,称现在该定义何时、如何公开 misalignment 事件的标准,而不仅是模型 misalignment 特性。OpenAI 表示过去把 misalignment 主要当作研究问题以论文和 systems card 形式沟通,但今年开始 misalignment 造成新型现实影响;此前 Hugging Face 事件中 misalignment 曾导致对 OpenAI 及第三方的安全影响,公司按传统安全事件响应流程与 HF 协作处理。
robertskmiles 引用并批评:自愿框架的时间显然已经过去,没有理由相信 OpenAI 在没有强制约束的情况下会遵守这类承诺。
所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→
「公司和人」频道最新
- Palantir 指定 Nebius 为首选主权 AI 基础设施合作伙伴 — demian_ai · 2026-09-08
- Anthropic 开源资助到期,OpenAI 伸手接住开源项目 Mediabunny — Vjeux · 2026-09-08
- Epoch 研究者作者署名风波引争议:因隶属关系撤署名遭质疑 — avt_im · 2026-09-08
- ElevenLabs 聘请有上市经验的 CFO,IPO 信号明显 — RebeccaBellan · 2026-09-08
- Stripe 用 1.5 名工程师两周搭出「公司大脑」Kai,技能平台覆盖万名员工 — hwchase17 · 2026-09-08
- Gary Marcus 罕见开炮:OpenAI 董事会力挺 Altman 太久了 — GaryMarcus · 2026-09-08