Inception 扩散模型让语音 Agent 无需再买定制芯片换低延迟

victor_explore · x · 2026-09-20

Inception CEO Stefano Ermon 介绍,一家语音 AI 公司此前为了达到延迟目标而采购 Cerebras 定制芯片;而 Inception 的扩散模型因为是并行解码、速度来自软件层面,如今在普通可租用的 Nvidia GPU 上就能拿到同样的延迟,成本更低。发帖人 victorexplore 总结观点:定制芯片曾是购买低延迟的唯一途径,现在它变成了软件里可选的一种解码策略,语音 Agent 的延迟预算因此变得更便宜。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →