PRISM 原型语言模型:一次前向传播即可追溯 token 来源
keunwoochoi · x · 2026-10-06
介绍 PRISM(Prototype Language Models):一类专为可解释性设计的语言模型,其下一 token 预测可以在单次前向传播中直接追溯到具体的预训练数据。作者 Dan 在 Guide Labs 实习期间完成这项工作,将在 COLM 会议上展示。
所属事件:COLM 论文提出 PRISM:前向传播即可追溯训练数据(3 条相关)→
「研究」频道最新
- Claude 协助 Lean 形式化 11 方块装箱最优性证明 — ctjlewis · 2026-10-07
- 研究者提出 World Editing:不生成新世界而是编辑已有世界 — yuntiandeng · 2026-10-07
- 新研究追问:Agent 替你行动时,它到底站在谁那边 — ZacharyHuang12 · 2026-10-07
- RL 研究年度 Top 10 榜单出炉,Spurious Rewards 居首 — ShayneRedford · 2026-10-07
- SciConBench 团队:每两月跑一轮评测,寻找资金维持公开榜单 — manoelribeiro · 2026-10-07
- 动态基准 SciConBench:AI 合成医学结论 61–90% 含事实错误 — manoelribeiro · 2026-10-07