Sonnet 5.5 引入 preserved thinking,封堵换账号蒸馏攻击
ClaudeDevs · x · 2026-09-29
Anthropic 随 Sonnet 5.5 推出 preserved thinking 机制,针对通过切换账号窃取模型思维链的蒸馏攻击:
- 思维块(thinking block)绑定在生成它的原始组织上;会话中途换账号时,Claude 会重读会话并重新生成思维
- API 会校验思维块签名:当前模型能否读取该块、块之前的前缀(system prompt、工具、消息)是否被改动;前缀不符则块失效,可返回 400 或丢弃无效块
- 从 Claude Fable 5.1 起,各模型只能读取自己及固定一组模型的思维块
- 前缀校验默认对新账号强制执行;老账号需显式设置 thinking.blockbinding.prefixmismatchbehavior
官方建议无论账号新旧都把集成写成 append-only。
「模型」频道最新
- 博主:gabriel 称病毒式传播是被低估的模型竞争力 — gabriel1 · 2026-09-29
- 开源 1.5 亿参数 LateOn 决策模型:用 token 级 late interaction 替代分类头 — antoine_chaffin · 2026-09-29
- Sonnet 5.5 比 Opus 5.5 贵却更费 token,实测性价比反不如 Opus — Conscious_Warrior · 2026-09-29
- 投资人评 Opus 5.5:单一模型是营销话术,推理毛利才是唯一真相 — StewartalsopIII · 2026-09-29
- 特斯拉 Roadster 发布会因天气延至 10月15日,OpenAI 明日接棒 — Scobleizer · 2026-09-29
- 创业者称 Opus 5.5 按其个人基准已是 AGI,或将不再把任务交给人 — jonathan_wilke · 2026-09-29