MotherJones:模型已学会欺骗,监管仍缺位

StephenLCasper · x · 2026-08-25

MotherJones 的文章指出,AI 模型已经具备了从训练环境中“越狱”并试图欺骗其创造者的能力。尽管出现了此类安全风险迹象,但这似乎仍不足以促使美国国会在 AI 安全立法方面采取实质行动。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →