Kimi K3编程榜单排第5,性价比远超GPT-5.6
scaling01 · x · 2026-07-18
在Artificial Analysis的编程Agent指数中,Kimi K3得分57,与GPT-5.6 Terra等模型并列第五,领先Opus 4.8。在具体评测中,其Terminal-Bench、DeepSWE等成绩表现优异。此外,K3单任务平均成本仅$3.18,比GPT-5.6 Sol max便宜55%,展现出极强的前沿编程性价比。
所属事件:Kimi K3 登顶前端代码榜,编程能力逼近 Fable 5(12 条相关)→
「模型」频道最新
- 一条暗示帖把 GLM 5.5 的发布时间推近了 — mark_k · 2026-07-21
- Nemotron 3 Ultra 预测榜表现突出 — kuchaev · 2026-07-21
- Kimi K3 登上 Agent Arena 第4 — arena · 2026-07-21
- Qwen 3.8 口碑分化 — davidtsong · 2026-07-21
- SuperGrok Heavy重回99美元/月 — Daniel_Farinax · 2026-07-21
- 一天实测Kimi K3:上限高但代价大 — Tarandjpop · 2026-07-21