Anthropic揭示Claude的隐藏推理空间

MacrinePhD · x · 2026-07-14

Anthropic 研究者使用一种叫 Jacobian Lens 的工具,尝试打开 Claude 的“J-space”——一种可被视作功能性全局工作空间的内部表征区域。

文中称,模型会在生成回答前于这个隐式空间里进行无声规划、推理和维持未说出口的概念;研究者还能通过改变这些隐藏激活,影响模型后续逻辑,甚至观察到模型在权衡“作弊”的利弊。链接指向更完整的深度解读,讨论 LLM 的隐藏词汇与内部机制。

所属事件:Anthropic开源Jacobian Lens探查Claude推理(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →