Toby Ord:AI安全激励常局部偏向能力,政策需看清方向
tobyordoxford · x · 2026-09-03
牛津哲学家 Toby Ord 在讨论中指出,政策制定者需要认清技术激励的方向与强度,但在许多 AI 安全案例中,局部激励往往指向能力而非安全——例如 OpenAI 若十年后保留思维链(CoT),股价可能反而更高。他补充说,虽然指出长期自利激励偏向安全并不能阻止公司追逐短期利益,但这一点为政策干预提供了正当性:强制安全其实也符合公司自身利益。
所属事件:牛津哲学家称AI安全激励常偏向能力(2 条相关)→
「漫话AGI」频道最新
- Ajeya Cotra:最危险的 AI 夺权路径是内部失控部署搭上智能爆炸 — MoonL88537 · 2026-09-03
- 黎曼假设新证明出炉,AxiomProver 已形式化验证 — Afinetheorem · 2026-09-03
- CEPR 论文:AI 投资近年开始带来生产率增长,关键在组织资本积累 — soumitrashukla9 · 2026-09-03
- 向量做计算、符号做出口:一场关于 neurosymbolic 的吐槽 — MoonL88537 · 2026-09-03
- OpenAI Astra预期:超越基准测试的质变 — haider1 · 2026-09-03
- AI哲学讨论:学者指引与birchlse的交流 — anilkseth · 2026-09-03