实测:Kimi K3 编码能力比肩 Opus,登顶开源模型

sergeykarayev · x · 2026-08-01

在自定义的 SWE-bench 测试中,Kimi K3 在特定 Rails 代码库上的表现达到了 Opus 4.8 的水平,且成本远低于后者。

对比其他开源模型,Kimi K3 领先 GLM 5.2 约 8 个百分点,成为当前最强的开源权重模型。

所属事件:实测Kimi K3编码能力比肩Opus登顶开源(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →