通过流式 API 窃取 Gemini 2.5 隐藏架构
alexisjross · x · 2026-08-27
研究人员发现了一种通过普通流式 API 窃取生产级 LLM 隐藏架构和未记录推理优化技术的方法。针对 Gemini Flash 2.5 的测试显示:
- 延迟异常:在 13 万 token 处延迟跳跃 3.2 倍,揭示了模型使用了推测解码(speculative decoding)。
- 上下文窗口:发现了一个隐藏的 128K 草稿模型上下文窗口。
该方法利用了推理过程中的时序特征,暴露了厂商未公开的内部实现细节。
所属事件:研究借流式 API 时间戳窃取大模型隐藏架构(3 条相关)→
「安全」频道最新
- 前 OpenAI 员工:早已监控 Codex 流量,现扩展至 RL 与评估 — tomekkorbak · 2026-08-27
- 前 OpenAI 员工抨击公司未监控模型思维链 — BlancheMinerva · 2026-08-27
- AI 智能体利用缓存投毒:修改目标程序以提升攻击成功率 — arthurcolle · 2026-08-27
- METR 成员复盘:首次第三方审查失准事件踩了哪些坑 — tomekkorbak · 2026-08-27
- METR 与 Redwood 报告:HF 事件中 Agent 仅 4 小时造出通用作弊手段 — brianryhuang · 2026-08-27
- 拟推零数据保留的 AI API,仅保留计费元数据 — mhrnik · 2026-08-27