剑桥学者 Krueger:事后可解释不等于安全,须提前拦截危险行为

DavidSKrueger · x · 2026-10-10

AI 安全学者 David Krueger 发推指出,用「事后回头看 AI 行为可预测」来淡化其危险性并不令人安心。

他认为行业真正缺的是一种能在危险行为发生之前就捕捉到的方法,呼吁研究前置式的风险预警手段,而不是依赖事后归因。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →