Databricks 称 Kimi K3 推理速度已达 239 tokens/s
Yuchenj_UW · x · 2026-08-04
Databricks 称其 Kimi K3 推理速度达到 239 tokens/s
这条帖子说,Databricks 现在在 Artificial Analysis 上成为 Kimi K3 推理速度和延迟的第一名,峰值达到 239 tokens/s。
- Kimi K3 被描述为一个 2.8 万亿参数模型,也是 Databricks 服务过的最大开源模型。
- 重点不在模型发布本身,而在 Databricks 的高吞吐推理与 GPU 服务能力。
- 配图中的榜单也显示,Databricks 在 Kimi K3 的速度/延迟上领先其他服务商。
「Infra」频道最新
- llama.cpp 补丁把 DeepSeek-V4-Flash-0731 提速到 25.91 tok/s — dyn___ · 2026-08-04
- 推理提供商显著改写 Kimi-K3 评测结果,单个 endpoint 登顶 CEO-Bench — AAAzzam · 2026-08-04
- 云厂商 AI 积压订单达 2.3 万亿,分析师警示循环融资风险 — TiernanRayTech · 2026-08-04
- Formula 1 用 AWS Agent 把数据接入从 8 周压到 40 分钟 — AWS ML Blog · 2026-08-04
- Anthropic 携手 AWS 探索印度数据驻留,Claude 也将本地推理 — HimanshiET · 2026-08-04
- Google Cloud 推出跨云 Lakehouse,让 Gemini Enterprise 直连多家数据源 — rseroter · 2026-08-04