Anthropic 基准显示前沿模型可攻破 65%–86% 的一级密码方案
AnthropicAI · x · 2026-07-29
Anthropic 联合 ETH Zurich、Tel Aviv University 和 University of Haifa 推出 CryptanalysisBench,用来测试 LLM 是否能做密码分析(cryptanalysis)。
- 基准共 191 个任务,覆盖 6 类密码原语,主要来自 4 个 NIST 标准化竞赛。
- 设计了三层任务:已知存在实际攻击的原语、没有已知实际攻击但会在完整强度和缩小版上评测的原语,以及更前沿的挑战集。
- 论文报告,Claude Opus 4.8、Sonnet 5、Mythos 5、GPT 5.5、GLM 5.2 这 5 个前沿模型,在 Tier 1 方案上可击破 65%–86%;在 Tier 2 中可击破 6–12 个完整强度方案、以及 24–61 个缩小版方案。
- 更重要的是,作者称模型还做出了新的密码分析发现,包括针对 SpoC AEAD 设计缺陷的密钥恢复攻击,以及对 KINDI 已发表 CCA 安全证明中错误的利用。
Anthropic 还链接了两篇相关论文,给出了两类攻击的完整技术细节。
所属事件:Anthropic发布CryptanalysisBench,Claude攻破多项密码方案(7 条相关)→
「研究」频道最新
- Anthropic Claude 破解后量子密码,加速 AES 攻击数百倍 — petrusenko_max · 2026-07-29
- 技术报告解读:外部模型初始化视觉编码器并非良策 — SeunghyunSEO7 · 2026-07-29
- AI 药物发现流程已覆盖小分子和纳米抗体实验验证 — const_reborn · 2026-07-29
- Jon Durbin 用每小时不到 10 美元预训练 20B MoE — const_reborn · 2026-07-29
- 商业 LLM 预训练再多,为什么下棋还是不行 — alex_peys · 2026-07-29
- 微软发布 Mage-VL:编码原生流式多模态模型,推理提速 3.5 倍 — pmttyji · 2026-07-29