剑桥学者:四大根本问题未解,AI 安全难靠限期攻关
剑桥大学 AI 安全研究者 David Krueger 指出当前 AI 安全研究面临四重困境:不了解 AI 系统如何工作(可解释性)、无法预测其行为(测试)、无法阻止其出错(对齐)、出错时无法确保纠正(控制),因此不能指望限期攻关解决。面对质疑他回应称,自己在四个方向均在顶级 AI 会议发表过工作,这些方法并非无效,但有效却不可靠且难以修复。
2026-09-22 ~ 2026-09-22 · 2 条相关
- 剑桥学者 David Krueger:四大根本问题未解,AI 安全不能指望限期攻关 — DavidSKrueger · 2026-09-22
- 剑桥研究者:AI 可解释与对齐方法有效但不可靠且无法修复 — DavidSKrueger · 2026-09-22