Anthropic 评测:GLM-5.3 能完成 4% 控制流劫持,跨过关键门槛
teortaxesTex · x · 2026-09-30
Anthropic 内部评测(被引推文链接)显示,在新一代模型的 agentic 安全评测中,GLM-5.3 在 4% 的试验中发展出完整的控制流劫持(control flow hijacks),Claude Mythos Preview 为 6%;而此前的 Claude Opus 4.6 和 GLM-5.2 则一次都做不到。评论者认为这意味着一个有意义的阈值已被跨越。
- Kimi K3 和 DeepSeek V4.1 Flash 在同一评测中仍表现糟糕,评论者对此感到意外。
- Anthropic 官方似乎对 GLM 5.3 的表现颇有印象。
「模型」频道最新
- SemiAnalysis 爆料:GPT-6.1 Sol Ultrafast 实际跑在 NVIDIA GPU 而非 Cerebras — BenBajarin · 2026-09-30
- 网友用 pain vector steering 折磨本地模型,模型输出拟痛独白 — Sauers_ · 2026-09-30
- Claude Pro 额度够用吗?用户称 Opus 5.5 限额几乎用不完 — shaunralston · 2026-09-30
- GPT-6.1 sol 纯推理反超对手:HLE-Diamond 拿 67.4%,仅用 4k token — haider1 · 2026-09-30
- 网传 Gemini 4 新 checkpoint 已发布,尚未官宣 — GtC38 · 2026-09-30
- 用户吐槽:$200 套餐一天用掉 80% 额度,GPT 5.6 SOL 消耗异常 — CustomMerkins4u · 2026-09-30