Mercury 2.5 登陆 OpenRouter,推理速度达 1107 tok/s
StefanoErmon · x · 2026-09-02
Inception AI 发布 Mercury 2.5 Preview,目前仅在 OpenRouter 上线。该模型主打推理速度,通过并行令牌生成达到每秒 1107 个 token 的吞吐量。新版本支持可调节推理、并行工具调用和模式对齐的 JSON 输出,专为对延迟敏感的工作流构建。
所属事件:Inception AI 发布 Mercury 2.5,推理速度超 1100 tok/s(2 条相关)→
「模型」频道最新
- Scale AI 发布 Muse Voice:实时语音转文字 SOTA — alexandr_wang · 2026-09-02
- Meta发布实时语音模型Muse,支持20人说话人分离 — bowenc0221 · 2026-09-02
- Gemini 新增智能体视频理解:Token 消耗降 88% — GoogleDeepMind · 2026-09-02
- Atlas 架构揭秘:多模态自回归扩散 Transformer 从零预训练 — theworldlabs · 2026-09-02
- World Labs 发布空间智能全模态世界模型 Atlas,将开放早期访问 — theworldlabs · 2026-09-02
- Fable 5.1 现身 Claude 官方支持文档,发布在即 — kimmonismus · 2026-09-02