Deft 发布:用分布微调修复 LLM 公式化写作
HamelHusain · x · 2026-08-20
Deft 是一个专注于改善 AI 写作的新模型和实验室。其研究论文指出,标准的 SFT(监督微调)会导致模型输出过于公式化(slop signs),过度使用特定 token 或短语。
Deft 提出了分布微调(DFT)算法,这是一种后训练步骤,能使模型输出分布更好地匹配训练数据分布。实验显示,DFT 将 MMD 改善了 49%,JMQ 改善了 63%。该模型在创造力、连贯性和清晰度上均有显著提升,且在 Pangram 检测中获得了 100% 的人类写作评分。
所属事件:AI写作实验室Deft发布公测模型,宣称86%输出通过Pangram人写检测(11 条相关)→
「研究」频道最新
- GPT-5 与 Gemini 2.5 Pro 夺国际天文奥赛金牌 — hhsun1 · 2026-08-20
- 放松链式规则引出新散度,Tilted ERM 提升泛化性 — burny_tech · 2026-08-20
- 上海新论文:智能体威胁随认知层级升级而演变 — rohanpaul_ai · 2026-08-20
- Steerling-8B:训练时植入可解释性的扩散模型 — burny_tech · 2026-08-20
- 信息几何基础:Frank Nielsen 教科书级论文 — FrnkNlsn · 2026-08-20
- PRL 框架新增自适应并发,提升 RL 训练效率 — samsja19 · 2026-08-20