训练多花30%算力,推理效果堪比翻倍投入

teortaxesTex · x · 2026-08-14

推文引用了开发者 @xidulu 的技术分享,介绍了一种新的模型训练范式。该方式通过引入(软性、自由的)潜在反馈解码以及融合双预填充加软解码等技术,在训练阶段仅需额外增加约 30% 的计算量,就能让模型的自由生成能力,达到与传统方式下使用两倍算力训练出的模型相当的水平。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →