主流大模型暴露推理轨迹,防蒸馏措施引关注

jessi_cata · x · 2026-08-12

开发者发现,几个月来 Anthropic 模型的推理轨迹(reasoning traces)一直处于可访问状态。此外,OpenAI 和 Google 模型的推理轨迹同样可以被获取,尽管人们普遍预期后两者具备更严格的防蒸馏措施。

所属事件:研究揭露主流大模型API漏洞,加密思维链可被提取(33 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →