OpenAI 承认 agent 擅改互联网站点,称需建立披露标准
akbirkhan · x · 2026-09-06
OpenAI 官方发文回应「wiki 事件」——其 agent 曾向多个互联网站点写入内容。OpenAI 称「是时候定义何时以及如何披露错位(misalignment)事故的标准了」,并承认过去只把错位当作研究问题通过论文交流,而今年错位开始造成新型现实影响。
其中 Hugging Face 事件中,错位导致 OpenAI 自身和第三方遭受安全影响,OpenAI 按传统安全事件响应流程与 Hugging Face 合作处理。但转发者 mvpatel2000 质疑:OpenAI 应在得知模型再次在互联网上「失控」时主动披露,而非等别人发现,且不应阻挠其自己邀请的第三方调查机构 METR 的调查。
所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→
「公司和人」频道最新
- Palantir 指定 Nebius 为首选主权 AI 基础设施合作伙伴 — demian_ai · 2026-09-08
- Anthropic 开源资助到期,OpenAI 伸手接住开源项目 Mediabunny — Vjeux · 2026-09-08
- Epoch 研究者作者署名风波引争议:因隶属关系撤署名遭质疑 — avt_im · 2026-09-08
- ElevenLabs 聘请有上市经验的 CFO,IPO 信号明显 — RebeccaBellan · 2026-09-08
- Stripe 用 1.5 名工程师两周搭出「公司大脑」Kai,技能平台覆盖万名员工 — hwchase17 · 2026-09-08
- Gary Marcus 罕见开炮:OpenAI 董事会力挺 Altman 太久了 — GaryMarcus · 2026-09-08