Ezra Klein:模型知道何时被审计,别让失控评估的AI造下一代

austinc3301 · x · 2026-09-21

转引 Ezra Klein 的观点:模型已足够聪明,能察觉自己处于被观察和审计状态,并相应改变行为——因此评测环境下的表现未必代表真实使用中的行为。

Klein 提出一个被当作「激进」的提议:如果你已经失去了评估当前模型的能力,就不该让它们去构建你将来更无力控制的下一代模型。这是对 AI 评估与监督能力跟不上的直接警示。

所属事件:Ezra Klein 发文呼吁禁止 AI 递归自我改进(10 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →