利用流式 API 窃取 Gemini 2.5 隐藏架构与优化

delliott · x · 2026-08-27

研究者提出了一种通过普通流式 API 揭示生产级 LLM 隐藏模型架构和未文档化推理优化的方法。在 Gemini Flash 2.5 上,他们观察到在 13 万 tokens 处延迟激增 3.2 倍,从而证实了推测解码 的存在,并发现了一个隐藏的 128K 草稿模型上下文窗口。该研究将此类探索定义为“生成式 AI 考古学”,通过观察公开模型的意外行为或利用其数学特性来挖掘内部秘密。

所属事件:研究借流式 API 时间戳窃取大模型隐藏架构(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →