Databricks 在 Kimi K3 基准中拿下最快与最低延迟
mrdrozdov · x · 2026-08-04
关键结论
Artificial Analysis 对 Kimi K3 (max) 的 10 家 API 提供商做了对比,维度包括输出速度、首 token 延迟和综合价格。
- Databricks 同时拿到 最快输出速度 和 最低延迟,分别是 218.8 tokens/s 和 10.31s。
- Wafer (FAST) 排第二,分别是 194.5 tokens/s 和 11.14s。
- Fireworks 以 166.7 tokens/s 和 13.14s 紧随其后。
- 价格方面,最低综合成本为 $2.31 / 100 万 tokens,由 Kimi、Fireworks、Modal、Together AI、DigitalOcean 共同占据。
报告还指出,不同提供商之间的速度差异很大,最快与最慢之间相差 637%。
「Infra」频道最新
- 中国 AI 芯片出货量或从 380 万升至 2028 年 1290 万 — teortaxesTex · 2026-08-04
- 长上下文语音 Agent 取消 turn detection,改用异步压缩切换 — juberti · 2026-08-04
- MiniMax H3 首日支持本地部署,最低只需两张 RTX 5090 — yvbbrjdr · 2026-08-04
- MiniMax H3 在 ComfyUI 实测:1280×704 要 14–15GB 显存和 1 小时以上 — ayakitodev · 2026-08-04
- Atomic 发布 14 个 DeepSeek V4 Flash 量化版,主推 128GB 机器 — testingcatalog · 2026-08-04
- 引用帖看多:未来两年 neoclouds 可能迎来一轮大涨潮 — abhiadesai · 2026-08-04