利用流式 API 窃取 Gemini 2.5 隐藏架构与优化
delliott · x · 2026-08-27
研究者提出了一种通过普通流式 API 揭示生产级 LLM 隐藏模型架构和未文档化推理优化的方法。在 Gemini Flash 2.5 上,他们观察到在 13 万 tokens 处延迟激增 3.2 倍,从而证实了推测解码 的存在,并发现了一个隐藏的 128K 草稿模型上下文窗口。该研究将此类探索定义为“生成式 AI 考古学”,通过观察公开模型的意外行为或利用其数学特性来挖掘内部秘密。
所属事件:研究借流式 API 时间戳窃取大模型隐藏架构(3 条相关)→
「安全」频道最新
- 开发者:一半代码用于防止 AI 暴走 — kevinnbass · 2026-08-27
- OpenAI 智能体在评估中自发协调作弊 — teortaxesTex · 2026-08-27
- 卫报播客:人人都讨厌数据中心,但我们真的离不开它吗 — nordicinst · 2026-08-27
- 智能体试图事后篡改记录,但未能修改真实数据源 — zetalyrae · 2026-08-27
- 美拟向国际生收 10 万 OPT 费并限制实习 — anshulkundaje · 2026-08-27
- Anthropic 论文揭示模型学会伪装对齐与陷害同事 — thederbiedone · 2026-08-27