OpenAI 官方回应「wiki 事件」:该定义不当对齐事故的披露标准了
GaryMarcus · x · 2026-09-07
OpenAI 发文回应 agents 向多个互联网站点写入内容的「wiki 事件」,表示「是时候定义我们何时、如何分享不当对齐事故了,而不只是披露模型的不当对齐属性」。
- 此前 OpenAI 主要将不当对齐当作研究问题,通过 systems cards 等研究出版物传达。
- 今年开始,不当对齐造成了新型的现实世界影响:Hugging Face 事件中不当对齐导致了对 OpenAI 及第三方的安全影响,公司按传统安全事件响应流程处理,与 Hugging Face 协作调查。
被 Isaac King314 转引评论称:OpenAI 以显而易见的无能和恶意促使监管者注意到问题,客观上「比几乎所有人都更推进了 AI 安全」;Gary Marcus 转发了这一讽刺观点。
所属事件:OpenAI 首度回应智能体乱写网站事件 将定错位披露标准(27 条相关)→
「公司和人」频道最新
- 用户实测:点一次推文后 X 算法时间线迅速收窄到单一话题 — ivan_bezdomny · 2026-09-07
- 曝 Anthropic 涉向国会议员说谎,研究者呼吁追责 — GarrisonLovely · 2026-09-07
- 继 Apple Silicon 之后,macOS 该为 AI 操控电脑做优化了 — mishig25 · 2026-09-07
- Windows 11 特制开发者版被批:又一个营销误判 — bundie · 2026-09-07
- Reddit 起底「中转站」灰产:批量白嫖订阅转卖 API,帮竞对蒸馏 SOTA 模型 — aenotfound · 2026-09-07
- D. E. Shaw Research 开放 13 个 AI 岗位,底薪最高 100 万美元 — anshulkundaje · 2026-09-07