Mercury 2.5 推理速度达 770 tokens/秒,刷新 LLM 速度纪录

Retro_Dev · hn · 2026-09-24

据 Artificial Analysis 的评测数据,Mercury 2.5 的推理速度达到每秒 770 tokens,远超主流前沿模型的常规输出速度。Mercury 系列采用扩散式文本生成架构,这组数字进一步佐证了该路线在低延迟推理上的潜力。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →