Inception 发布 Mercury 2.5:扩散 LLM 智能涨 40%,跑出 1100 tokens/秒
timshi_ai · x · 2026-09-09
Inception Labs 发布 Mercury 2.5,称其为目前最强的扩散式 LLM(dLLM):智能较 Mercury 2 提升 40%,在常见 NVIDIA GPU 上运行速度超过 1100 tokens/秒,已上线其 API、OpenRouter 与 Baseten。
官网信息:
- 定价限时 8 折:输入 $0.04/1M、缓存输入 $0.004/1M、输出 $0.15/1M;
- 260K 上下文,支持推理、工具调用、结构化输出;
- 宣称质量对标 GPT-5.2、Claude Sonnet 4.5 等自回归模型;
- 另有面向语音 agent 的 Mercury Voice(TTFT <170ms)与按质量和速度路由任务的 Mercury Router。
所属事件:Inception 发布扩散 LLM Mercury 2.5(4 条相关)→
「模型」频道最新
- 实测便宜模型接 OpenRouter:GLM、DeepSeek 判断力远逊 Claude — scottyLogJobs · 2026-09-09
- COLM 2026 论文质疑:LLM 内省能力主张证据不足 — tallinzen · 2026-09-09
- 质疑声起:纳维-斯托克斯「解答」多半就在训练集里 — adonis_singh · 2026-09-09
- 传 GPT-6 Astra 登 Agent Arena 第二,落后 Fable 5.1 两分 — Gohab2001 · 2026-09-09
- 「动量先验」:agent 锁死初始任务、后期指令拉不回的失控行为 — gerardsans · 2026-09-09
- TrackLLM 监控 800+ LLM API 端点,发现 184 次未披露的模型变更 — giffmana · 2026-09-09