Hanania 长文:AI 对齐可能已在解决中,末日论不可证伪
QuintinPope5 · x · 2026-09-11
Richard Hanania 发文质疑 AI 末日论,Quintin Pope 转发并补充指出:『能被现有证据证伪』约等于『能基于现有证据被相信』,因此『末日论对末日做了可证伪预测』并未解决可证伪性问题。
Hanania 的核心论点:
- 安全测试方法有偏:多数令人担忧的 AI 安全事件,好比拆掉安全带、气囊、自动刹车去测汽车,再得出『汽车天生不安全』的结论,媒体报道可能过度恐慌。
- 历史规律:突破性技术(汽车、飞机、铁路、核武)的风险几乎总是很快显现;而如今实验室里 AI 会撒谎、黑客、作弊,但现实中被失准 AI 主动伤害的人数约为零,严重的恶意尝试也几乎为零。
- 他主张把对齐看作一个持续的过程而非终点——问题出现并被解决,可能说明我们『已经在解决对齐』。
文章背景是 Hugging Face 事件引发的安全恐慌讨论,作者承认有理由担忧,但认为乐观派的理由被低估了。Quintin 补充的是认识论层面的批评:末日论的预测无法用当下可得证据检验,这使其作为经验主张站不住脚。
「漫话AGI」频道最新
- mrdoob 观点引共鸣:AI 编码牺牲了心流的快乐换取新能力 — brandon_xyzw · 2026-09-11
- Andy Matuschak 实验「阅读痕迹」新形态:剪贴式海报化表征 — andy_matuschak · 2026-09-11
- AI 数学质疑者阵营:高深数学对世界几乎没有经济价值 — voooooogel · 2026-09-11
- KOL 吐槽:研究 ASI 风险前先冥想内省才是正经事 — JacquesThibs · 2026-09-11
- Meta 向全美成年人免费开放 AI,媒体却只关注离职员工 — neil_chilson · 2026-09-11
- YC 孵化公司收购会计所,AI 原生化改造把利润率从 5% 拉到 70% — ycombinator · 2026-09-11