「极性探针」论文入选 COLM 2026:线性解码 LLM 内部语义结构
JeanRemiKing · x · 2026-10-07
论文《Polar probe linearly decodes semantic structures from LLMs》被 COLM 2026 接收,作者团队包括 itspablit0、PierreOrhan、Emmanuel Chemla、lakretz 与 JeanRemiKing(Meta AI 研究员)。
核心发现:LLM 内部的语义结构存在一种简单的几何形式,「极性探针」(polar probe) 可以线性地解码出模型表示中的语义结构,为理解大模型如何组织概念提供了可解释性视角。作者附有推文线程展开细节。
「研究」频道最新
- LLM2Vec-Gen:冻结 LLM 单次前向生成答案嵌入,登上 COLM 2026 — sivareddyg · 2026-10-07
- 研究揭示混合架构 LLM 几乎只用注意力,辅助训练可逼出循环记忆价值 — mohitban47 · 2026-10-07
- 研究者提出 World Editing:不生成新世界而是编辑已有世界 — yuntiandeng · 2026-10-07
- 新研究追问:Agent 替你行动时,它到底站在谁那边 — ZacharyHuang12 · 2026-10-07
- RL 研究年度 Top 10 榜单出炉,Spurious Rewards 居首 — ShayneRedford · 2026-10-07
- SciConBench 团队:每两月跑一轮评测,寻找资金维持公开榜单 — manoelribeiro · 2026-10-07