研究称闭源模型加密推理过程可被 100% 还原
Dany0 · reddit · 2026-08-11
Reddit 网友分享了一篇论文指出,OpenAI 等闭源模型的加密推理(encrypted reasoning)过程是 100% 可还原的。作者借此呼吁社区抓紧时间,在厂商修复该漏洞前,向 Hugging Face 上传大量 Anthropic Claude 等模型的推理轨迹数据。
所属事件:研究揭示API漏洞可提取加密思维链并现蒸馏证据(38 条相关)→
「安全」频道最新
- AI 安全研究员发文评 OpenAI 事件,称其如生化危机 — JacquesThibs · 2026-08-13
- TrustedSec 深度文章:AI 进攻并非穿墙外挂 — cyb3rops · 2026-08-13
- 马萨诸塞州一青少年涉嫌在 ChatGPT 协助下杀害母亲与兄弟 — nbcnews · 2026-08-13
- AI 对齐研究者反思:现有 RLHF 与 HHH 框架过于简单 — sebkrier · 2026-08-13
- AI对齐探讨升温:多元视角聚焦价值与治理困境 — sebkrier · 2026-08-13
- 教授断言:再强的 ASI 也造不出无法破解的 AI 水印 — emollick · 2026-08-13