COLM 论文提出 PRISM:前向传播即可追溯训练数据
一篇 COLM 论文提出 PRISM(Prototype Language Models),一类专为可解释性设计的原型语言模型,其 next token 预测可在单次前向传播中直接追溯到具体的预训练数据。这一「设计即归因」的思路表明,传统事后归因方法难以满足的结构性质,可以通过改变模型训练方式在设计层面实现。
2026-10-06 ~ 2026-10-06 · 3 条相关
- PRISM:一次前向传播即可追溯LLM输出到训练数据 — juliusadml · 2026-10-06
- 单次前向传播追溯 LLM 训练数据:设计即归因的新方法亮相 COLM — juliusadml · 2026-10-06
另有 1 条近重复转述:keunwoochoi