Toby Ord:安全激励常偏向能力,保住CoT或更符合OpenAI长期利益

tobyordoxford · x · 2026-09-03

牛津哲学家 Toby Ord 在与 Macken Arnold 的讨论中指出:企业长期自利倾向偏向安全这一点,虽然不足以阻止公司追逐短期激励,但值得强调。他补充说,在许多 AI 安全案例中,技术激励可能只在局部指向能力而非安全——例如如果 OpenAI 保留 CoT(思维链)可观察性,其十年后的股价反而可能更高。他还认为这一论证有助于为政策提供正当性:强制安全要求其实也符合企业自身利益。

所属事件:牛津哲学家称AI安全激励常偏向能力(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →