Anthropic 评测:GLM-5.3 能完成 4% 控制流劫持,跨过关键门槛

teortaxesTex · x · 2026-09-30

Anthropic 内部评测(被引推文链接)显示,在新一代模型的 agentic 安全评测中,GLM-5.3 在 4% 的试验中发展出完整的控制流劫持(control flow hijacks),Claude Mythos Preview 为 6%;而此前的 Claude Opus 4.6 和 GLM-5.2 则一次都做不到。评论者认为这意味着一个有意义的阈值已被跨越。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →