攻击揭秘:用时间戳窃取模型架构与推理优化

niloofar_mire · x · 2026-08-27

最新研究 LeakyLMs 提出一种通过分析 Token 生成时间来窃取模型架构和推理优化的攻击方法。研究利用了推测解码技术在特定上下文长度(130k tokens)导致的延迟跳变(Gemini Flash 2.5 上达 3.2 倍),成功推断出 Google 使用了未公开的 128K 上下文草稿模型。此外,通过建立计算图与时间的关联模型,研究还能从黑盒 API 推断出模型的层数、隐藏层维度和注意力头数,并在 Llama 3.1 8B 上验证了准确性。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →