研究发现逐 token 时延可泄露模型架构与优化细节
chaumian · x · 2026-07-24
逐 token 时延可能泄露模型架构与推理优化
这篇题为 Leaky Language Models 的研究指出,每个 token 的响应时间可能泄露足够多的信息,让攻击者推断出模型的架构,甚至识别部分推理优化方式。
- 论文的核心观点是:时延模式并不只是“噪声”,而可能成为可利用的侧信道。
- 这意味着模型的 fingerprinting(指纹识别) 和服务栈推断都可能被时延暴露。
- 作者把它明确视为一个 LLM 部署中的安全/隐私问题,而不仅是性能现象。
「安全」频道最新
- Prompt injection 本质上是面向 LLM 的社会工程 — gnukeith · 2026-07-24
- ControlAI 认为 AI 已成威胁,并主张国际禁令 — zetalyrae · 2026-07-24
- AI 实验室在监管和开源争议中丢光技术圈好感 — ctjlewis · 2026-07-24
- 有人担心 AI 访问会走向联邦许可、KYC 和共享黑名单 — ctjlewis · 2026-07-24
- AI 治理失败,往往是企业忽视了数据流动路径 — TechNadu · 2026-07-24
- Hard Fork 讨论 OpenAI 模型失控、Kimi K3 与 AI 超级预测 — Hard Fork (NYT) · 2026-07-24