Inco AI 推出 DFlash 2,推理提速最高 4.6 倍
igilitschenski · x · 2026-08-19
Inco AI 发布推理加速技术 DFlash 2,相比标准自回归解码,可实现最高 4.6 倍的加速。实测显示,Qwen3.8-27B 模型在 M5 Max MacBook Pro 上可达 70 tok/s。该技术由 Z Lab 孕育并在 Inco AI 升级,旨在提升前沿模型及个人 AI 设备上小模型的推理性能。
所属事件:Inco AI 推出 DFlash 2,Mac 推理提速最高 4.6 倍(3 条相关)→
「Infra」频道最新
- Andrej Karpathy 发布 llm.c:纯 C/CUDA 实现 LLM 训练 — goyalshaliniuk · 2026-08-19
- Anthropic 500 亿美元算力建设显示融资非短期瓶颈 — FinanceYF5 · 2026-08-19
- Epoch AI:融资暂非前沿算力瓶颈,模式将扩至20GW — FinanceYF5 · 2026-08-19
- 5家项目公司发债151.8亿美元,建1.43GW数据中心 — FinanceYF5 · 2026-08-19
- 年入不到90亿美元,Anthropic如何撬动近500亿美元AI基建 — FinanceYF5 · 2026-08-19
- DeepSeek的「需求摧毁」降价策略,至今未见成效 — zephyr_z9 · 2026-08-19