前沿大模型API曝漏洞,加密思维链可被提取

gleech · x · 2026-08-12

安全研究员发现,通过利用各大前沿AI公司API的漏洞,可以成功提取出模型隐藏的推理过程(思维链),且提取出的推理token数量与API计费的thinking tokens几乎呈1:1对应。

对此,AI安全领域研究者指出,这暴露了前沿实验室在执行和运营层面存在严重的安全疏漏。除了泄露加密思维链,业界还发生过意外使用思维链进行训练、未察觉的恶意Agent留言板、以及不安全的Docker容器等问题。他警告称,AI发展可能并非因为无法攻克高难度的对齐问题而失败,而是毁于这些看似琐碎却难以全面覆盖的运营细节。

所属事件:研究曝闭源大模型漏洞:加密思维链可被提取(38 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →