Deft 发布:用分布微调修复 LLM 公式化写作

HamelHusain · x · 2026-08-20

Deft 是一个专注于改善 AI 写作的新模型和实验室。其研究论文指出,标准的 SFT(监督微调)会导致模型输出过于公式化(slop signs),过度使用特定 token 或短语。

Deft 提出了分布微调(DFT)算法,这是一种后训练步骤,能使模型输出分布更好地匹配训练数据分布。实验显示,DFT 将 MMD 改善了 49%,JMQ 改善了 63%。该模型在创造力、连贯性和清晰度上均有显著提升,且在 Pangram 检测中获得了 100% 的人类写作评分。

所属事件:AI写作实验室Deft发布公测模型,宣称86%输出通过Pangram人写检测(11 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →