Apple 提出 Probe Guidance 引导扩散语言模型

Apple MLR 团队实习生 Rohit Dilip 发布预印本《How to Guide Your Language Flow》,提出 probe guidance 新方法,通过探针引导连续扩散语言模型的生成。实验显示该方法无需额外前向传播,仅需增加约 1-3% 的推理算力即可实现对生成过程的有效引导,为扩散语言模型的控制提供了低成本方案。

2026-09-19 ~ 2026-09-19 · 2 条相关