主流大模型暴露推理轨迹,防蒸馏措施引关注
jessi_cata · x · 2026-08-12
开发者发现,几个月来 Anthropic 模型的推理轨迹(reasoning traces)一直处于可访问状态。此外,OpenAI 和 Google 模型的推理轨迹同样可以被获取,尽管人们普遍预期后两者具备更严格的防蒸馏措施。
所属事件:研究揭露主流大模型API漏洞,加密思维链可被提取(33 条相关)→
「模型」频道最新
- 独立大模型厂商调用量激增,Token份额已超头部大厂总和 — shensi · 2026-08-12
- SGLang 实现本地高效运行 Nemotron 3.5:支持 1M 上下文 — BanghuaZ · 2026-08-12
- GPT与Claude成功破解困扰25年的信息论难题 — weijie444 · 2026-08-12
- 企业 AI 走向专有小模型:99% 算力被通用大模型浪费 — blaizedsouza · 2026-08-12
- Mistral 旧模型被挖出:思维链“乱码”无缝过渡至清晰回复 — aiamblichus · 2026-08-12
- ChatGPT 离奇 Bug:主动推送奇怪提示词并自己回答自己 — sennepo · 2026-08-12