Mercury 2.5 发布:推理速度超 1100 tok/s
volokuleshov · x · 2026-09-02
Inception AI 发布 Mercury 2.5 预览版,这是新一代 Mercury 扩散模型。该模型通过并行令牌生成技术,在 OpenRouter 上实测速度达到 1,107 tokens/sec。新版本针对智能体工作负载进行了优化,支持可调推理、并行工具调用及 Schema 对齐的 JSON 输出,现已上线 OpenRouter。
所属事件:Inception AI 发布 Mercury 2.5,推理速度超 1100 tok/s(2 条相关)→
「模型」频道最新
- Scale AI 发布 Muse Voice:实时语音转文字 SOTA — alexandr_wang · 2026-09-02
- PINNACLE 基准按「每正确任务成本」打分:模型已够好,该问谁决定升级 — ryanshrout · 2026-09-02
- Meta发布实时语音模型Muse,支持20人说话人分离 — bowenc0221 · 2026-09-02
- Gemini 新增智能体视频理解:Token 消耗降 88% — GoogleDeepMind · 2026-09-02
- Atlas 架构揭秘:多模态自回归扩散 Transformer 从零预训练 — theworldlabs · 2026-09-02
- World Labs 发布空间智能全模态世界模型 Atlas,将开放早期访问 — theworldlabs · 2026-09-02