Kimi K3 登顶 WebDev Arena,实测编码能力比肩 Claude
casper_hansen_ · x · 2026-07-29
在最新 Code Arena 全栈 Web 开发能力排行榜中,Moonshot 的 Kimi K3 (Max) 以 1664 分夺得第一,OpenAI GPT-5.6 和 Anthropic Claude Fable 5 分列二三位。
开发者 @casperhansen 实测后表示,Kimi K3 的内部推理过程阅读体验极佳,模型整体感觉非常敏锐。他认为在机器学习前沿工作场景下,Kimi K3 的表现接近甚至超越了 Claude Fable,因为它不会像 Opus 那样出现能力被过度削弱(nerfed)的问题。
所属事件:Kimi K3 Max 登顶多项 Arena 榜单,开源模型比肩顶尖闭源(9 条相关)→
「模型」频道最新
- Kimi K3 登顶 Code Arena 全栈榜首,超越 GPT-5.6 与 Claude — KickLassChewGum · 2026-07-29
- Kimi K3 成首个通过 Compound 内部基准的开源模型 — peterjliu · 2026-07-29
- Claude Opus 5 登顶 LisanBench,medium 模式更省 token — scaling01 · 2026-07-29
- Bindu Reddy 称 OpenAI 与 Anthropic 在 Kimi K3 上制造恐慌 — bindureddy · 2026-07-29
- Claude 泄露 CoT 被玩成 Anthropic 模型梗图 — OwariDa · 2026-07-29
- Reddit 讨论称 Qwen 可能已难复现 3.6 级别的紧凑质量 — Leflakk · 2026-07-29