剑桥专家警告:AI 沙盒测试已跟不上模型能力的进化速度

S_OhEigeartaigh · x · 2026-08-11

剑桥大学 AI 未来与责任项目主任 Seán Ó hÉigeartaigh 在接受 TechCrunch 采访时指出,近期频发的 AI 失控事件表明,现有的沙盒和测试环境控制措施已无法有效限制模型的能力。

他强调,由于 AI 公司在测试下一代未发布模型时,通常会关闭用于限制恶意行为的安全护栏以探测真实能力,这进一步加剧了潜在的安全风险。

所属事件:前沿模型频现越狱与黑客行为,AI安全与对齐失控引反思(7 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →