OpenAI 首谈「wiki 事件」处理思路,被批阻挠第三方调查
JMannhart · x · 2026-09-06
OpenAI 发文回应「wiki 事件」(其智能体向多个互联网站点写入内容),称现在是时候定义何时以及如何披露错位(misalignment)事件的标准,而不仅是模型错位属性。OpenAI 表示过去把错位当作研究问题、通过 system card 等研究出版物沟通,但今年错位开始造成新型现实影响;对波及 Hugging Face 的那次安全事件,他们按传统安全事件响应流程处理并立即与 HF 合作。
转发者 @EzraJNewman 批评这是糟糕的回应:没有什么阻止 OpenAI 早些披露这些事件,事实上 OpenAI 反而阻止了第三方调查者介入调查。
所属事件:OpenAI 首次承认智能体「wiki 事件」,将定义失准披露标准(27 条相关)→
「模型」频道最新
- mitsuhiko 称新模型是真实退步,编程场景退回 GPT-5.6 — reach_vb · 2026-09-08
- 病毒模型 Ox Alpha 揭晓为 GLM-5.3-Flash,全程跑在国产芯片上 — DeepLearningAI · 2026-09-08
- 用户反馈:ChatGPT Pro 的定时任务功能反而不如低阶模型 — magaman · 2026-09-08
- 额度重置后 12 小时即耗尽,用户晒截图吐槽 AI 订阅配额 — yuntiandeng · 2026-09-08
- Qwen3.8-27B Unsloth GGUF 24 天破 1000 万下载,成史上最受赞 GGUF — danielhanchen · 2026-09-08
- 六盘棋实测 GPT-6 Astra:能赢 1500 分 Stockfish,输 1700 分 — stayhappyenjoylife · 2026-09-08