Kimi K3 与 Fable 编程对比
ssh4net · x · 2026-07-19
在 Cline 的真实 bug 上做了同一套 harness 对比:Kimi K3 和 Fable 5 都能修复问题,但各有侧重。
- Fable 5 更快:总耗时 3.5 分钟、18 次工具调用;Kimi K3 为 12 分钟、34 次工具调用。
- Kimi K3 更省钱:用掉 1.2M tokens,花费 $0.92;Fable 5 用 730K tokens,花费 $2.13。
- 作者认为,轨迹显示 Kimi 更像经过强化学习训练,会花更多 token 做思考与验证。
- 结论是:这是他们第一次看到一个开源权重模型在真实 coding-agent 场景里与 SOTA 正面竞争。
所属事件:Kimi K3 评测成绩两极分化,工具链影响显著(5 条相关)→
「编程与Agent」频道最新
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11
- 实测质疑 RTK 省 token 说法:成本基准显示并不成立 — michalwarda · 2026-09-11