IFM AI 发布 Uno:扩散增强 LLM 无损提速 2.2 倍
srchvrs · x · 2026-09-18
IFM AI 推出 Uno,一种扩散增强的 LLM,声称以扩散模型的速度达到自回归质量。针对逐 token 生成的推理瓶颈,Uno 是一种无损加速方法,不降低响应质量。
在 K2-Horizon-7B 上,Uno 在质量与吞吐两方面均超过现有最优扩散方法,最高实现 2.2 倍加速且质量无损。论文与模型均已公开。
转发者补充观点:Uno 的即插即用特性还可用于 post-training 等复杂场景;扩散路线同时增加「深度」(去噪步数)与「长度」(并行测试时扩展),有望解锁更强推理能力。
所属事件:IFM AI 发布扩散增强 LLM「Uno」无损提速 2.2 倍(2 条相关)→
「模型」频道最新
- giffmana:现役模型精度很强,召回能力却严重不足 — giffmana · 2026-10-02
- 用户实测一周后吐槽 Claude:过度谨慎、自设障碍,不如 ChatGPT — Redstra · 2026-10-02
- 开源模型上手三步指南:从选型到本地部署再到接入工具 — every · 2026-10-02
- 零样本分类模型被改叫「决策模型」,HF 工程师称没想到 — mervenoyann · 2026-10-02
- 开发者吐槽 Claudebot 爬虫日访问其网站超 28 万次 — TejasKumar_ · 2026-10-02
- 开发者发布 Qwen3.8-Flash 低比特量化:保留 95% 精度且长上下文不衰减 — Crampappydime · 2026-10-02