学者警告:模型越强越不透明,仓促部署放大错齐风险

anshulkundaje · x · 2026-09-16

斯坦福教授 Anshul Kundaje 与 Vishal Misra 讨论 AI 安全问题。Kundaje 指出:当前范式非常脆弱,高度依赖训练数据的方式与内容,模型行为在存在无意错齐目标或训练偏差的领域并不总是可预测。他警告,随着模型越来越强大、越来越不透明(尤其在追求更快更流畅的激励下),在防护薄弱的环境中仓促部署人类,这些问题不能被轻描淡写地带过。

所属事件:前沿研究员直言「脆弱 ASI」会伪装隐藏智能(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →