Jacobian lens:刻画模型未来可能输出的token向量
Sauers_ · x · 2026-07-07
一段研究内容介绍了“Jacobian 镜头”(Jacobian lens)方法:对模型词表中的每个 token,该方法识别出一个向量表示,刻画模型在未来“说出”该 token 的潜力。具体做法是对每一层计算某个激活对该 token 产生概率的平均线性化效应,并在大量语料上取平均。
该平均步骤是关键,可区分“可被言说”(verbalizable,即一旦场合出现就准备被谈论)的表示与那些只是碰巧被言说的表示。
所属事件:Anthropic发现Claude内部存在全局工作空间(102 条相关)→
「研究」频道最新
- LagTag 染色质记录研究正式发表,AI 助力基因史追踪 — arjunrajlab · 2026-09-03
- SIGGRAPH Asia 2026 差旅资助开放申请,9 月 18 日截止 — tomaszbednarz · 2026-09-03
- 100 个已知错误实测 AI 同行评审:最强系统抓 71 个,多模型集成达 93 个 — alejandroll10 · 2026-09-03
- EMNLP 论文:从零预训练对比发现罗马化文本跨语言迁移最优 — TuhinChakr · 2026-09-03
- HydroGym 登 Nature:60+ 环境训练 AI 控制流体力学 — ricardovinuesa · 2026-09-03
- 让 Agent 活过模型更替:新论文把持久身份与可换组件分离 — omarsar0 · 2026-09-03