Anthropic 扩展 Preserved Thinking,防跨账号蒸馏攻击
ClaudeDevs · x · 2026-09-29
Anthropic 宣布将 preserved thinking 机制扩展到 Sonnet 5.5,以遏制通过切换账号进行的蒸馏攻击:thinking 块绑定到生成它的原始组织,若会话中途切换账号,Claude 会重新读取会话并生成新的 thinking。
文档细节:模型只能读取自身及固定白名单模型的 thinking 块(无法读取时直接丢弃不报错);thinking 块生成前的前缀(system prompt、tools、之前的消息)若有改动,块即失效,返回 400 错误或按配置丢弃。前缀校验对 2026 年 8 月 31 日后创建的账号默认强制生效,老账号需显式设置 thinking.blockbinding.prefixmismatchbehavior。
所属事件:Anthropic 发布 Claude Sonnet 5.5:提速 30%、多数任务成本降三成(30 条相关)→
「模型」频道最新
- AI 急诊诊断准确率 78%,主治医生仅约 30% — realmeetjames · 2026-09-29
- Bindu Reddy 吐槽 Sonnet 5.5 不如 Terra,仍推荐 DeepSeek Flash — bindureddy · 2026-09-29
- 获早期体验者称 Sonnet 5.5 较 5.0 巨幅提升,速度极快 — rudrank · 2026-09-29
- 创意写作基准更新:覆盖 56 模型、超 10 万条评审判定 — zero0_one1 · 2026-09-29
- Meta 研究发现:AI 评委更偏爱 AI 味浓的写作,基金评审或同病 — jmugan · 2026-09-29
- Anthropic IPO 推迟至 11 月,传正测试全模型 5.5 为 Claude 6 蓄力 — fsharpman · 2026-09-29