剑桥学者 David Krueger:四大根本问题未解,AI 安全不能指望限期攻关

DavidSKrueger · x · 2026-09-22

剑桥大学 David Krueger 概括了当前 AI 安全研究的四重困境:我们不了解 AI 系统如何工作(可解释性)、无法预测其行为(测试)、无法阻止其出错(对齐)、出错时无法确保控制权(控制)。

他指出这四个方向尽管研究了多年,基础问题仍未解决,因此不能指望靠 deadline 攻关在期限内解决这些问题——这是对「限期确保前沿模型安全」思路的直接回应。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →