Kimi K3 编程任务性价比更高
rohanpaul_ai · x · 2026-07-19
图中对比了 **Kimi K3** 和 **Fable 5** 在软件工程 / DeepSWE rollout 任务上的表现: - 按每 $100 成本计算,Kimi 完成 **14.7** 个任务,Fable 为 **5.3** 个,约 **2.8x** 的单位成本产出优势。 - 代价是单次 rollout 更慢:Kimi 中位数 **66 分钟**,Fable 为 **21 分钟**。 - 引用内容补充说,这个结果可能会在模型正式发布、广泛可用后继续变化。
所属事件:Kimi K3 登顶前端代码榜,编程能力逼近 Fable 5(12 条相关)→
「模型」频道最新
- 有人称 OpenAI 和 Anthropic 抱怨中国开源权重模型很荒谬 — krishnan · 2026-07-21
- PrismML Bonsai 27B 量化后仅 3.8GB 可手机运行 — tony10000 · 2026-07-21
- actAVA AI 推出 1T 参数医疗代理模型 Cura — _akhaliq · 2026-07-21
- 有人觉得 Claude Fable 出现了更像 Gemini 的僵硬感 — teortaxesTex · 2026-07-21
- Reddit 实测:z.ai 上的 GLM-5.2 确实能网页搜索 — Umr_at_Tawil · 2026-07-21
- Kimi CEO 称 token 效率才是 Kimi 3 的新优势 — HowDevelop · 2026-07-21