DeepSWE评测:Kimi K3达到Claude Fable 5同等能力,成本仅35%

togethercompute · x · 2026-07-22

Together AI 基于 DeepSWE 基准对软件工程任务进行了模型对比测试。

结果显示,Kimi K3 能够以约 35% 的价格达到与 Claude Fable 5 相当的性能水平。此外,在更高的 pass@k 设置下(即允许模型进行更多次尝试),Kimi K3 的表现甚至实现了反超。

所属事件:Kimi K3软件工程能力比肩Fable 5,成本仅三分之一(7 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →