连续扩散语言模型新技巧:仅增 1-3% 推理算力即可引导生成
itsbautistam · x · 2026-09-19
rohitdilip 介绍的 probe guidance 方法:通过探针引导连续扩散语言模型(continuous dLMs)的生成,实验显示只需增加约 1-3% 的推理算力即可获得好效果,且与领域无关(domain agnostic)。作者表示对近期连续 dLM 的进展感到兴奋,但在如何最佳引导语言模型上仍有许多工作要做。
所属事件:Apple 提出 Probe Guidance 引导扩散语言模型(2 条相关)→
「研究」频道最新
- 15 个被审计 benchmark 作者:评估应视为持续改进过程 — sarahcat21 · 2026-09-19
- OpenDDE 将结构预测与蛋白质设计插件带入 Codex 和 Claude Code — AllThingsApx · 2026-09-19
- 长文辨析世界模型:Agent 需要的不是 RAG 而是状态追踪 — techNmak · 2026-09-19
- 176 组实验拆解 Coding Agent Harness:上下文管理弱模型时最关键 — _akhaliq · 2026-09-19
- 斯坦福/哈佛论文:Agent 失败不在智力差,而在不会中途改计划 — PolarBearby · 2026-09-19
- Turbo-dLLM 开源:新并行策略让长上下文扩散 LLM 训练提速至 7.59 倍 — Azaliamirh · 2026-09-19