Toby Ord:安全激励常偏向能力,保住CoT或更符合OpenAI长期利益
tobyordoxford · x · 2026-09-03
牛津哲学家 Toby Ord 在与 Macken Arnold 的讨论中指出:企业长期自利倾向偏向安全这一点,虽然不足以阻止公司追逐短期激励,但值得强调。他补充说,在许多 AI 安全案例中,技术激励可能只在局部指向能力而非安全——例如如果 OpenAI 保留 CoT(思维链)可观察性,其十年后的股价反而可能更高。他还认为这一论证有助于为政策提供正当性:强制安全要求其实也符合企业自身利益。
所属事件:牛津哲学家称AI安全激励常偏向能力(2 条相关)→
「漫话AGI」频道最新
- Ajeya Cotra:最危险的 AI 夺权路径是内部失控部署搭上智能爆炸 — MoonL88537 · 2026-09-03
- 黎曼假设新证明出炉,AxiomProver 已形式化验证 — Afinetheorem · 2026-09-03
- CEPR 论文:AI 投资近年开始带来生产率增长,关键在组织资本积累 — soumitrashukla9 · 2026-09-03
- 向量做计算、符号做出口:一场关于 neurosymbolic 的吐槽 — MoonL88537 · 2026-09-03
- OpenAI Astra预期:超越基准测试的质变 — haider1 · 2026-09-03
- AI哲学讨论:学者指引与birchlse的交流 — anilkseth · 2026-09-03