SFT 只遮响应是元凶:全序列掩码解锁扩散模型 prompt infilling

kastnerkyle · x · 2026-09-24

Patronus AI 的论文被 COLM 2026「非自回归语言模型」workshop 接收,研究 masked diffusion 语言模型(如 LLaDA、Dream)为何无法从期望输出反推 prompt。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →