扩散模型 Mercury 2.5 上线:发布价 8 折,语音延迟压到 200ms 内

StefanoErmon · x · 2026-09-09

Inception Labs 的扩散语言模型 Mercury 2.5 已通过官方 API 及 OpenRouter、Baseten 提供,新账号赠 1 亿 tokens。发布促销价为输入 $0.04/M、输出 $0.15/M tokens(8 折)。官方举例:OpenCall AI 用 Mercury 在真实患者通话中跑语音 agent,从某 AI 推理芯片方案迁移后,p50 延迟降到 200ms 以内,p99 从数分钟降到 1 秒,使多步推理能装进实时通话的延迟预算。

所属事件:Inception 发布扩散 LLM Mercury 2.5(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →