剑桥学者:四大根本问题未解,AI 安全难靠限期攻关

剑桥大学 AI 安全研究者 David Krueger 指出当前 AI 安全研究面临四重困境:不了解 AI 系统如何工作(可解释性)、无法预测其行为(测试)、无法阻止其出错(对齐)、出错时无法确保纠正(控制),因此不能指望限期攻关解决。面对质疑他回应称,自己在四个方向均在顶级 AI 会议发表过工作,这些方法并非无效,但有效却不可靠且难以修复。

2026-09-22 ~ 2026-09-22 · 2 条相关