偷走专有模型推理痕迹:加密设计的工程权衡全复盘
bendee983 · x · 2026-08-19
软件工程师视角解读《Stealing Reasoning Traces from Proprietary LLM APIs》研究,指出 AI 公司本可避免全局加密密钥这类基础安全失误。\n\n但深挖后发现没有完美答案:厂商想防蒸馏所以要加密;想跨模型复用对话所以只用单一密钥;想少在服务端存客户数据所以把加密的推理痕迹发给客户端——既要又要,结果搞砸了一堆东西,包括让更小、更不安全的模型也卷入风险。
「安全」频道最新
- Zvi 评论“AI 工具应追随用户”:拒绝公司强加的意识形态 — TheZvi · 2026-08-19
- 观点:当下是推动实验室互相暂停训练的时机 — geoffreyirving · 2026-08-19
- 观点:若视开源为威胁,应黑掉 Hugging Face — wordgrammer · 2026-08-19
- 白宫科技办主任谈开源AI支持与监管策略 — ycombinator · 2026-08-19
- 观点:精心编辑的 AI 文本虽难逃检测但仍有破绽 — tokenbender · 2026-08-19
- 让模型厂商自测基准,如同学生自己监考SAT — MattPerault · 2026-08-19