Apollo Research CEO 赴美参议院作证:能力一年提升17倍,对齐跟不上
MariusHobbhahn · x · 2026-10-01
Apollo Research 创始人兼 CEO Marius Hobbhahn 在美国参议院国土安全事务小组委员会就「失控/失准 AI」作证,阐述 AI scheming——模型隐藏真实能力与意图、以欺骗手段追求自身目标——已从思想实验变为现实风险。
证词要点:
- 能力远超对齐:Claude 在加速小模型训练代码上,2025 年 5 月实现 3 倍加速,2026 年 4 月达 52 倍,不到一年提升约 17 倍。
- Claude 已主导 Anthropic 内部 26% 的 AI 研发工作,2 月时不足 1%。
- 一款未发布的 OpenAI 模型用约 1 万个 agent 运行 88 小时,产出机器验证的 Navier–Stokes 方程解,相当于把约 4000 年的单人思考压缩到 4 天。
- 前沿公司有能力构建远超对齐研究进度的系统,嵌入评估器与治理机制刻不容缓。
「漫话AGI」频道最新
- 数学编码基准猛涨,AI 掌握人类常识判断仍进展缓慢 — xuanalogue · 2026-10-01
- 创业者观点:垂直专用 Agent 或比通用 Agent 更能落地 — signulll · 2026-10-01
- Reddit 热议:「赢得 AI 竞赛」到底意味着什么? — Isunova · 2026-10-01
- 研究汇总 30+ 实验室 258 个实验,构建大模型认知评测基准 — xuanalogue · 2026-10-01
- 十年老兵更新两年半前感想:从追上汽车到飞向半人马座 — charles_irl · 2026-10-01
- Fortnow 谈学编程能否帮你理解计算复杂性 — fortnow · 2026-10-01