攻击还原推理过程,专有 LLM API 暴露思维链
Machine Learning Street Talk · youtube · 2026-08-23
本期节目探讨了 Ilia Shumailov 和 Alexander Panfilov 的论文《Stealing Reasoning Traces from Proprietary LLM APIs》。攻击利用了一个设计缺陷:服务商为了支持会话恢复,返回了加密的推理状态(Traces)。攻击者可以将这些状态块在不同用户或模型间重放,利用较小的模型诱导服务商解密并明文输出隐藏的推理过程。讨论涵盖了隐私数据泄露、通用的越狱攻击路径、被投毒的 Agent 追踪以及防御措施,呼吁进行受控实验而非过度宣传。
「安全」频道最新
- 美AI数据中心引发暴力威胁,共和党视其为选举风险 — rohanpaul_ai · 2026-08-24
- 达美航空被曝用 AI 实时个性化定价,乘客被差别收割 — CSProfKGD · 2026-08-24
- Claude 用户大量聊天记录与创作遭 Google 搜索意外曝光 — jonerp · 2026-08-24
- 特朗普称国会可让 AI 倒闭,折射监管与国力的冲突 — VraserX · 2026-08-24
- macOS 版 Codex 绕过 TCC 权限泄露 ChatGPT 历史记录 — mer__edith · 2026-08-24
- 芝加哥大学社科课将禁 AI,引教育模式争论 — soumitrashukla9 · 2026-08-24