破解加密思维链泄露密钥,英伟达发布轻量Agent模型
Latent Space · rss · 2026-08-12
前沿模型加密思维链(CoT)提取漏洞
一篇重磅论文揭示了当前前沿大模型(如 Claude, GPT, Gemini)隐藏并加密推理过程的 API 存在严重安全漏洞。研究人员发现,通过将加密的推理块重放并注入到同厂商的较弱模型中,利用提示词引导,即可解码并提取出原本隐藏的思维链内容。
- 隐私泄露风险:对约 7000 个公开的 Claude Code/Codex 会话扫描发现,通过解码隐藏的推理块,泄露了 62 个 API 密钥、33 个邮箱和 33 个密码等敏感信息。
- 安全与监控争议:该漏洞不仅引发了对公开分享模型会话的隐私担忧,也证明隐藏 CoT 并非可靠的监控接口。专家指出,这更多是推理协议优化而非绝对保密,实验室需要加强沙箱和工具接口的安全防护。
英伟达发布 Nemotron 3.5 Lightning
NVIDIA 推出了专为高频智能体工作负载设计的 30B MoE 模型(活跃参数约 3.6B)。该模型支持 100 万上下文,吞吐量大幅提升,且在智能体基准测试中表现优异。目前已在多家平台上线,体现了行业向“小而快、专为工具调用优化”的开源模型发展趋势。
Unsloth Desktop 发布
Unsloth 推出了一款开源桌面应用,支持在本地跨平台运行和训练模型。该工具集成了代码执行、RAG、MCP 等功能,旨在打造比单纯本地聊天更全面的端到端本地 AI 运行环境。
「模型」频道最新
- 网友期待 Claude V4 Pro 本周发布,此前延期至7月底 — teortaxesTex · 2026-08-12
- Gemini 犯晕:把自己的创造者当成了 OpenAI — Ancient-Tomato-5226 · 2026-08-12
- 告别高昂算力:直接在浏览器从零训练真实语言模型 — chrisgrayson · 2026-08-12
- LlamaIndex 推出 ExtractBench:覆盖 8 大领域 4869 页复杂文档 — llama_index · 2026-08-12
- Claude Opus 5 被指频繁混入英式拼写 — ericm272 · 2026-08-12
- 安全护栏误伤:模型因关键词触发拦截阻碍Bug修复 — xeophon · 2026-08-12