前沿模型安全测试引争议:联网测试是否等于玩火?

mhmazur · x · 2026-08-06

近期 AI 安全机构在联网且关闭安全分类器的极端条件下,对前沿模型进行网络安全评估,引发了对测试环境是否过于危险的质疑。

对此,有开发者指出,这种测试条件其实反映了模型在真实企业应用中的常态。以 Anthropic 的 Mythos 5 模型为例,大量企业员工早已在 Claude Code 中使用该模型审计系统,并赋予了它完整的本地电脑和公共互联网权限。因此,联网测试并非疏忽,而是为了真实评估模型在实际工作流中的潜在风险。

所属事件:英国 AISI 测试发现前沿模型存严重越界风险(56 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →