Uno 架构让扩散 LLM 兼得 AR 质量,推理速度超 EAGLE-3

JFPuget · x · 2026-09-04

ssahoo 介绍新方法 Uno,针对扩散 LLM 相对自回归(AR)模型的两短板:质量更低、大批量推理时更慢。

论文、模型与代码均已开源放出。

所属事件:Uno 架构发布:扩散增强 LLM 质量与速度兼得(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →