曝 Anthropic 模型思维链可被提取,跨模型越狱攻击生效

jessi_cata · x · 2026-08-12

有用户发现,可以通过跨模型可移植性提取 Anthropic 模型的隐藏思维链。

具体而言,通过一定的越狱手段,可以让较小的 Haiku 4.5 模型逐字转录 Opus 4.8 的原始推理过程,而无需直接攻击 Opus 本身。该用户指出,同样的跨模型思维链窃取技巧对 OpenAI 和 Gemini 的模型同样有效。

所属事件:研究揭露主流大模型API漏洞,加密思维链可被提取(33 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →