Sakana AI 的 UnMaskFork 用多个扩散语言模型做推理时扩展
SakanaAILabs · x · 2026-07-29
Sakana AI 的 UnMaskFork 被日经 xTECH 重点报道:这项工作围绕扩散语言模型展开,尝试利用多个模型的“集合智力”来实现推理时 scaling。
文章引述论文第一作者三崎航的观点称,这类推理时放大方法不会很快过时,因为即使未来模型继续进化,它仍然能继续适用。报道也强调,扩散语言模型仍处在研究早期,而这类理论工作对后续模型发展有基础性意义。
「研究」频道最新
- 研究发现,LLM 生成 CVE 标签并不能提升 ATT&CK 映射 — CIRCL · 2026-07-29
- 数学论文厘清扩散采样器与 PF-ODE 的严格条件 — chaumian · 2026-07-29
- GTX 1650 4GB 上的 Blender 图生视频实战方案 — Haziq12345 · 2026-07-29
- Krea 2 做 LoRA 训练 16GB 显存够用,但会泄漏到无触发词提示 — Economy_Cucumber_702 · 2026-07-29
- 帖子称 TMLR 的 Q2 排名偏低,审稿流程反而更好 — canaesseth · 2026-07-29
- 小模型低带宽互联通信,可能是个很有前景的方向 — dosco · 2026-07-29