Toby Ord:AI安全激励常局部偏向能力,政策需看清方向

tobyordoxford · x · 2026-09-03

牛津哲学家 Toby Ord 在讨论中指出,政策制定者需要认清技术激励的方向与强度,但在许多 AI 安全案例中,局部激励往往指向能力而非安全——例如 OpenAI 若十年后保留思维链(CoT),股价可能反而更高。他补充说,虽然指出长期自利激励偏向安全并不能阻止公司追逐短期利益,但这一点为政策干预提供了正当性:强制安全其实也符合公司自身利益。

所属事件:牛津哲学家称AI安全激励常偏向能力(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →