Anthropic 扩展 Preserved Thinking,防跨账号蒸馏攻击

ClaudeDevs · x · 2026-09-29

Anthropic 宣布将 preserved thinking 机制扩展到 Sonnet 5.5,以遏制通过切换账号进行的蒸馏攻击:thinking 块绑定到生成它的原始组织,若会话中途切换账号,Claude 会重新读取会话并生成新的 thinking。

文档细节:模型只能读取自身及固定白名单模型的 thinking 块(无法读取时直接丢弃不报错);thinking 块生成前的前缀(system prompt、tools、之前的消息)若有改动,块即失效,返回 400 错误或按配置丢弃。前缀校验对 2026 年 8 月 31 日后创建的账号默认强制生效,老账号需显式设置 thinking.blockbinding.prefixmismatchbehavior。

所属事件:Anthropic 发布 Claude Sonnet 5.5:提速 30%、多数任务成本降三成(30 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →