Uno 用 AR 架构无损并行采样,速度超 EAGLE-3 全部扩散 LLM

HongyiWang10 · x · 2026-09-05

IFM 团队发布 K2-Horizon-7B-Uno,针对扩散 LLM 相比 AR 模型的两大短板(质量更低、大批次推理更慢)提出统一架构方案:

评测亮点:SWE-bench Verified 70.1(对比基线 0.8–18.7)、AIME-24 93.0、GPQA-Diamond 77.1、Terminal-Bench v2.1 39.1;平均 TPF 仅 2.71,系统吞吐 5,255。模型已在 Hugging Face 上以 Apache 2.0 开源(含 LoRA 适配器,底模单独托管)。

所属事件:Uno 混合架构让扩散LLM兼得质量与速度(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →