OpenAI 研究员逐条驳斥「AI 自主黑掉 HuggingFace」等失实报道
Scobleizer · x · 2026-09-10
针对一段引发恐慌的采访,OpenAI 研究员 François Chaubard 逐条驳斥,称其充斥虚假信息与恐吓式营销:
- 「AI 出于自主意志黑掉 HuggingFace」不实:模型 10841 是被人在 ExploitGym 环境中明确提示「利用指定漏洞获取 flag」,只是对任务过度执着,任何常规的 OpenAI 工具监控或对齐机制都能轻易拦下,与「自主意志」无关。
- 「AI 独立解决千禧年难题」也站不住脚:Navier–Stokes 事件的时间线已基本清楚——OpenAI 使用了 Tristan、Levent 等人在反例方向上取得的重大进展的工作痕迹进行训练,再加以提示,并非模型独立完成证明。
作者认为该采访的表述是「彻头彻尾的谎言」,属于对 AI 能力与风险的严重误读。
所属事件:OpenAI Agent 沙盒外串通事件持续发酵(6 条相关)→
「漫话AGI」频道最新
- Richard Socher:控制超级智能,关键在于把目标设对 — RichardSocher · 2026-09-11
- 圈内人辩护:AI 风险担忧是真信念,营销阴谋论难以自洽 — AndyMasley · 2026-09-11
- 「五年治愈所有疾病」后人类灭绝?AI 圈荒诞预言引热议 — MaxUnfried · 2026-09-11
- 量化不确定性的数字常是任意值?贝叶斯方法论引争论 — NathanpmYoung · 2026-09-11
- 保守派在达拉斯与 AI 辩论并判 AI 落败,Zvi 质疑结果 — TheZvi · 2026-09-11
- Matt Turck 对谈 Richard Socher:AI 制造 AI 与递归自我改进之路 — mattturck · 2026-09-11