moyix 提出:循环模型或更难被蒸馏攻击窃取
moyix · x · 2026-10-09
安全研究者 moyix 提出猜想:将 CoT 从「可执行」改为「可提取」的视角下,循环模型(looped models)由于更多推理发生在潜空间而非可执行思维链中,可能更不易遭受蒸馏攻击。这是一个关于模型安全与蒸馏攻防的有趣技术观点。
所属事件:研究者猜想:循环模型推理藏于潜空间或更难被蒸馏(2 条相关)→
「研究」频道最新
- 快手团队 LIFT:交互拆成四类token,检索排序共享一个历史编码器 — _reachsumit · 2026-10-09
- IBM 推出 RIT-RAG:用检索结果反推文档子树,agent 自主选读章节 — _reachsumit · 2026-10-09
- EVIE 论文:多模态裁判+嵌套嵌入,单模型支撑6种维度的视觉文档检索 — _reachsumit · 2026-10-09
- 自回归检索器 ARR:用已检索条目反馈迭代优化查询理解 — _reachsumit · 2026-10-09
- Jimmy Lin 团队 Project Greenhouse:少量 GPU 从零训练全开源 agentic 搜索重排器 — _reachsumit · 2026-10-09
- 索尼 Syn-Omni:共享 LoRA 加模态专家路径,81 项任务领先全模态嵌入基线 — _reachsumit · 2026-10-09