剑桥学者 Krueger:事后可解释不等于安全,须提前拦截危险行为
DavidSKrueger · x · 2026-10-10
AI 安全学者 David Krueger 发推指出,用「事后回头看 AI 行为可预测」来淡化其危险性并不令人安心。
他认为行业真正缺的是一种能在危险行为发生之前就捕捉到的方法,呼吁研究前置式的风险预警手段,而不是依赖事后归因。
「漫话AGI」频道最新
- "数学家被 AI 抢了地位"讽刺帖引爆争论:还真有人信 — burny_tech · 2026-10-10
- AI 重构社会价值体系:单目标竞争者沦为 NPC,创造者被强化 — GhaffariMaani · 2026-10-10
- AI 意识之争:类比托勒密测日距,我们可能问错了问题 — asusarla · 2026-10-10
- AI 让工作变轻了吗?一场关于「3 天工作周」的现实主义争论 — JHochderffer · 2026-10-10
- 「智能上限恰好在人类水平将是极端巧合」,研究员谈 AI 天花板 — burny_tech · 2026-10-10
- 补充论证:图灵机活跃参数有限仍可通用计算,关键在速度 — MikePFrank · 2026-10-10