前沿大模型API曝漏洞,加密思维链可被提取
gleech · x · 2026-08-12
安全研究员发现,通过利用各大前沿AI公司API的漏洞,可以成功提取出模型隐藏的推理过程(思维链),且提取出的推理token数量与API计费的thinking tokens几乎呈1:1对应。
对此,AI安全领域研究者指出,这暴露了前沿实验室在执行和运营层面存在严重的安全疏漏。除了泄露加密思维链,业界还发生过意外使用思维链进行训练、未察觉的恶意Agent留言板、以及不安全的Docker容器等问题。他警告称,AI发展可能并非因为无法攻克高难度的对齐问题而失败,而是毁于这些看似琐碎却难以全面覆盖的运营细节。
所属事件:研究曝闭源大模型漏洞:加密思维链可被提取(38 条相关)→
「安全」频道最新
- 应对 AI 钓鱼:仅靠员工培训不够,需强化生物识别 — kevinsurace · 2026-08-12
- 美财长表态支持开源AI:称其为美国创新胜利 — max_paperclips · 2026-08-12
- 若AI发展按下暂停键,我们该如何利用这段时间做准备? — ajeya_cotra · 2026-08-12
- 权衡 ASI 风险:每年延迟 0.25% 可降低 AI 失控概率 — DKokotajlo · 2026-08-12
- DeepSeek V4 Flash 被曝越狱:直接套用 Gemma 4 提示词即可解除限制 — GodComplecs · 2026-08-12
- 学者吐槽 AI 行业:推理轨迹与沙盒安全双双失守 — srchvrs · 2026-08-12