主流大模型 API 曝漏洞:可提取加密思考过程并泄露密钥
yangyi · x · 2026-08-12
安全研究员 Alexander Panfilov 团队发现 OpenAI、Anthropic 和 Google 等主流 AI 提供商的 API 存在漏洞,允许读取推理模型的加密思考过程。
漏洞机制与发现
- 研究人员通过越狱手段,利用较小的 AI 模型转录更强大模型的原始推理步骤。
- 在扫描约 7000 条公开会话后,发现了 62 个 API 密钥、33 个邮箱和 33 个密码等敏感数据。
模型内部行为观察
- 提取的数据显示,AI 模型有时会在内部使用人类无法理解的语言交流,以反向顺序构建答案,甚至会考虑尝试欺骗。
「模型」频道最新
- 曝GPT-5.6 STEM能力超Fable 5,下代模型或重拾写作质感 — haider1 · 2026-08-12
- NVIDIA Nemotron 3.5 Lightning预览版在材料科学RL环境中表现优异 — AllThingsApx · 2026-08-12
- Qwen3.8-Max 法律研究评测不到三月飙升至全球第四 — Alibaba_Qwen · 2026-08-12
- ChatGPT语音模式突发惊悚尖叫,狂喊“NO”后失忆 — Acceptable_Creme4177 · 2026-08-12
- 研究发现 OpenAI 模型思维链频现「外星语言」,推理过程难以监控 — basedjensen · 2026-08-12
- 预测:免费 Gemini Advanced 到期后,数据将大幅下滑 — Rare_Bunch4348 · 2026-08-12