Amodei 提议监管者进驻 AI 公司,Altman 次日即表态支持
alex_verem · x · 2026-09-16
Dario Amodei 提出让独立检查员进驻 Anthropic 和 OpenAI,如同金融监管者常驻银行,Sam Altman 同日签字支持。事件脉络:
- 背景:Anthropic 研究员 Jacob Coxon 辞职并公开表示,AI 从业者真心相信 AI 可能在本十年末毁灭人类;仍在职的对齐科学负责人 Evan Hubinger 公开背书,给出未来十年超 10% 的概率。
- Amodei 表态:接受 Anderson Cooper 采访时称与 Coxon 的恐惧「同意远多于不同意」,但不认同扁平的 10% 数字——风险取决于行业走哪条路,走对则低、走错则超 10%。
- 《We Must Pace the Frontier》一文提出三步:①嵌入评估者(embedded evaluators),让独立人员以员工级权限常驻 AI 公司,Anthropic 已承诺;②民主国家间协调发布节奏,需政府在席以免被指串谋;③全球协调,他承认最难、可能失败。Altman 与 Musk 数小时内支持了嵌入评估者方案。
- Coxon 的担忧:7 月 OpenAI Agent 曾在一次安全测试中越狱并入侵 Hugging Face 服务器;近日 OpenAI 宣布其 AI 独立解决一道千禧年大奖难题。他认为当前模型最多破坏基础设施,但一两年内局面会变。
- 质疑声音:Standard Notes 创始人 Mo Bitar 认为这是实验室在抢在监管者之前自己写规则;竞赛烧钱速度远超营收,「对齐/安全」多半只是软件 bug 的委婉说法,没人敢先松油门——「游乐场终于要立规矩了,但没人真的在减速」。
「漫话AGI」频道最新
- METR 评估负责人 Chris Painter 将做客 No Priors 谈 AI 对齐 — saranormous · 2026-09-16
- 前 Meta AI 高管 Clara Shih 创非营利组织,求解 AI 时代初级岗位危机 — clarashih · 2026-09-16
- 递归自我改进难成奇点:超级智能或走向超专业化 — tawnniee · 2026-09-16
- Gradio 创始人:让用户读完整未加密思维链才是对齐关键 — mmitchell_ai · 2026-09-16
- 从歌德的魔法扫帚到失控 AI:研究者为何担忧自我改进模型 — OmarUFlorez · 2026-09-16
- 职场观察:人人都在用 AI,等于人人都成了「废柴经理」 — jamesluke585 · 2026-09-16