PRISM:一次前向传播即可追溯LLM输出到训练数据

juliusadml · x · 2026-10-06

PRISM(Prototype Language Models)是一类让语言模型的 next token 预测在单次前向传播中即可追溯到预训练数据的原型模型。作者将在 COLM 的 Poster Session 1 展示这项工作,目标是让模型输出的来源可解释、可审计,而不是黑盒生成。

所属事件:COLM 论文提出 PRISM:前向传播即可追溯训练数据(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →