Kimi K3 登顶 Arena 全栈编程榜,力压 GPT-5.6 与 Claude

iamfakhrealam · x · 2026-07-29

Kimi K3(Max)在 Arena 新公布的全栈编程测试中拿到第 1 名,超过了 GPT-5.6 Sol(xHigh)和 Claude Fable 5。

这项测试不是只看代码片段,而是要求模型端到端做出可运行的 Web 应用:要会规划任务、改文件、跑命令、接数据库、处理鉴权和 API,最后交付可部署的应用。

评审会再从功能、易用性以及是否符合需求等维度比较成品。这个结果说明,Kimi K3 目前在“完整项目协同执行”上表现相当强。

所属事件:Moonshot Kimi K3 Max 登顶多项 Arena 榜单(11 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →