DeepMind 控制计划主创警告:模型有动机操纵安全测试求部署

vkrakovna · x · 2026-10-08

Google DeepMind 研究员 Mary Phuong(AI control 计划、危险能力评估框架、scheming 评估框架的第一作者)接受 Palisade 采访,谈及 AI 风险。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →