NAVER AI 论文:LLM 推理运算在隐藏层表示中几何可分
naver-ai · hf · 2026-09-07
NAVER AI 的机制可解释性研究《Beneath the Surface of Chains-of-Thought》揭示了 LLM 推理过程的内部结构。
- 语言模型中不同的推理运算(reasoning operations)在隐藏表示中是几何上可分离的
- 这种结构随层深度逐渐涌现,且依赖于上下文中的推理情境
- 为理解 CoT 推理在模型内部如何组织提供了机制层面的证据
「研究」频道最新
- 从 GEN-1.5 八个月 loss 曲线看预训练与 Scaling 的通用方法论 — CatAstro_Piyush · 2026-09-07
- 合成物理训练让视觉模型从太空检测更微弱的甲烷泄漏 — bravo_abad · 2026-09-07
- DeepMind Co-Scientist 自主跑实验,三种二维半导体一次长出单晶 — jiqizhixin · 2026-09-07
- 基准无法衡量的失败:优化不等于范式转变的长文思辨 — Left-Character4280 · 2026-09-07
- 研究探究:调低模型情感表达是否会影响其内在情绪状态 — edelwax · 2026-09-07
- MBZUAI 新方法:冻结 VLM 无需重训即可完成语音中心全模态理解 — MBZUAI · 2026-09-07