Kimi K3 代码评测领先 DeepSeek-V4,但性价比差近 14 倍
rohanpaul_ai · x · 2026-08-14
在最新的 Code Arena: WebDev 早期自动评测中,Kimi K3 (Max) 以 1674 分位居开源模型榜首,而 DeepSeek-V4-Pro (Max) 以 1607 分紧随其后。
尽管 Kimi 在榜单上领先 67 分,但其 API 定价远高于 DeepSeek。对于 100 万 token 的输入和输出负载,使用 Kimi 的成本约为 18 美元,而 DeepSeek 仅需约 1.3 美元,性价比高出近 14 倍。
分析指出,Arena 的分数差异并不直接等同于代码质量的线性差距。只有在 Kimi 能够在实际开发环境中显著减少错误重试和人工审查成本时,其高昂的溢价才具有合理性。
「模型」频道最新
- 用户吐槽DeepSeek V4-Pro长项目卡顿,刷新后进度反而领先 — teortaxesTex · 2026-08-14
- 分析称 Google 凭借搜索规模优势,正全力押注更小更快的 AI 模型 — haider1 · 2026-08-14
- Notion推出真实流量模型评测看板,拒绝传统刷榜 — ivanhzhao · 2026-08-14
- DeepSeek V4 Pro 上线 Baseten:1.7T 参数 MIT 协议开源 — baseten · 2026-08-14
- 马斯克“合法即可发”成空谈,Grok 严防名人色情合成 — firasd · 2026-08-14
- 开发者吐槽 Anthropic 模型静默降级 — samgoodwin89 · 2026-08-14