牛津哲学家称AI安全激励常偏向能力

牛津哲学家 Toby Ord 在与 Macken Arnold 的讨论中指出,在许多 AI 安全案例中,局部激励往往指向能力而非安全。他举例称,OpenAI 若在十年后仍保留思维链(CoT)等技术,可能更符合其长期利益。Ord 强调,企业长期自利虽倾向于安全,但这不足以阻止公司追逐短期激励,因此政策制定者需要认清技术激励的方向与强度。

2026-09-03 ~ 2026-09-03 · 2 条相关

另有 1 条近重复转述:tobyordoxford