PRISM 原型语言模型:一次前向传播即可追溯 token 来源

keunwoochoi · x · 2026-10-06

介绍 PRISM(Prototype Language Models):一类专为可解释性设计的语言模型,其下一 token 预测可以在单次前向传播中直接追溯到具体的预训练数据。作者 Dan 在 Guide Labs 实习期间完成这项工作,将在 COLM 会议上展示。

所属事件:COLM 论文提出 PRISM:前向传播即可追溯训练数据(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →