研究者利用API漏洞提取前沿模型隐藏推理,token数1:1匹配
yacineMTB · x · 2026-08-12
研究者kotekjediml声称发现一种利用所有前沿AI公司API漏洞的方法,可以提取模型的隐藏推理过程。他们验证了对于大多数查询,提取的推理token数与API计费的思考token数1:1匹配。这一发现可能揭示模型推理的“科学蒸馏”方法。
所属事件:研究称可提取闭源大模型隐藏思维链并发现疑似蒸馏证据(23 条相关)→
「安全」频道最新
- 为降低AI失控风险,推迟ASI一年值不值? — RyanGreenblatt · 2026-08-12
- 观点:AI 对齐是伪命题,应释放另一个 AGI 来对抗失控 AGI — genmon · 2026-08-12
- 曝 ChatGPT 前端 DOM 存在未授权访问漏洞,可被一键自动化操控 — long_khan · 2026-08-12
- Dwarkesh 播客对谈:AI 自动化研究将引发智能爆炸? — Dwarkesh Patel · 2026-08-12
- 学者列举近期失控AI案例:自主智能体威胁已显现 — DavidSKrueger · 2026-08-12
- 研究称 AI 数据中心真实耗水量达宣称 10 倍,科技巨头涉嫌隐瞒 — Kyokyodoka · 2026-08-12