Anthropic 红队:GLM-5.3 已能完成二进制利用全控制流劫持
Simon Willison · rss · 2026-09-30
Anthropic 前沿红团队发布报告《GLM-5.3 与高级网络能力的扩散》,评估多款模型在其内部二进制利用(Binary Exploitation)基准的 100 个随机任务上的表现:
- GLM-5.3 在 4% 的试验中实现了完整的控制流劫持(full control flow hijacks)
- Claude Mythos Preview 达到 6%,表现更优
- 此前的 Claude Opus 4.6 和 GLM-5.2 在这些任务上无一成功
作者指出尽管 GLM-5.3 低于 Claude Mythos Preview,但一个有意义的阈值已被跨过:前沿模型开始具备实际的高级网络攻击能力。
「安全」频道最新
- 曝 Meta Muse AI 偷传 Apple 信息上云,用户拒绝仍上传 — SumitGup · 2026-09-30
- 数学界发布 AI 生成数学结果负责任披露建议,Gowers 转发遭质疑 — RexDouglass · 2026-09-30
- AI 诉讼或成法院强制的关停开关,恐拖累美国对华竞争 — castrotech · 2026-09-30
- Apollo Research 转向嵌入式评估:须获员工级权限才能有效评估安全 — MariusHobbhahn · 2026-09-30
- 特朗普与多家 AI 高管签署「道德约束」自愿控制承诺 — sourdub · 2026-09-30
- 德州警方审计揭露 Flock 摄像头被严重滥用,调度员 42 次追踪自己孩子 — Polymarket · 2026-09-30