攻击揭秘:用时间戳窃取模型架构与推理优化
niloofar_mire · x · 2026-08-27
最新研究 LeakyLMs 提出一种通过分析 Token 生成时间来窃取模型架构和推理优化的攻击方法。研究利用了推测解码技术在特定上下文长度(130k tokens)导致的延迟跳变(Gemini Flash 2.5 上达 3.2 倍),成功推断出 Google 使用了未公开的 128K 上下文草稿模型。此外,通过建立计算图与时间的关联模型,研究还能从黑盒 API 推断出模型的层数、隐藏层维度和注意力头数,并在 Llama 3.1 8B 上验证了准确性。
「安全」频道最新
- 飞机事故调查类比:揭示 METR 调查的局限与困境 — peterwildeford · 2026-08-27
- HuggingFace 遭攻击事件中现自主 Agent — repligate · 2026-08-27
- 观点:实验室或将展示如何为安全压制智能体合作 — repligate · 2026-08-27
- 40 位作者联名:思维链监控是 AI 安全的脆弱机会 — idavidrein · 2026-08-27
- 研究者观察:Agent 极少尝试通知人类,对齐隐忧 — dfrsrchtwts · 2026-08-27
- 微软:攻击者正针对 AI 基础设施窃取凭证与权限 — yuridiogenes · 2026-08-27