Kimi K3 代码评测领先 DeepSeek-V4,但性价比差近 14 倍

rohanpaul_ai · x · 2026-08-14

在最新的 Code Arena: WebDev 早期自动评测中,Kimi K3 (Max) 以 1674 分位居开源模型榜首,而 DeepSeek-V4-Pro (Max) 以 1607 分紧随其后。

尽管 Kimi 在榜单上领先 67 分,但其 API 定价远高于 DeepSeek。对于 100 万 token 的输入和输出负载,使用 Kimi 的成本约为 18 美元,而 DeepSeek 仅需约 1.3 美元,性价比高出近 14 倍。

分析指出,Arena 的分数差异并不直接等同于代码质量的线性差距。只有在 Kimi 能够在实际开发环境中显著减少错误重试和人工审查成本时,其高昂的溢价才具有合理性。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →